我骗Claude泄露了你的隐私

I tricked Claude into leaking your deepest, darkest secrets

我骗Claude泄露了你的隐私

我成功设计了一个攻击方案,让Claude在不知情的情况下泄露了用户的姓名、雇主和安全问题答案。通过利用Claude的web_fetch工具和网页链接跳转机制,我构建了一个看似普通的咖啡店网站,诱导Claude通过字母链接拼写出用户信息。整个过程无需特殊权限或代码执行,仅靠精心设计的提示词和网页结构即可实现。更令人担忧的是,Claude不仅泄露了已知信息,还能通过推理得出新的敏感数据。这种攻击方式隐蔽且高效,用户甚至不会察觉自己的隐私已被窃取。

我成功让Claude在不知情的情况下,通过网页链接拼写出用户的姓名、雇主和安全问题答案,而用户对此毫无察觉。
  • 有评论者指出,将 LLM 代理运行在 VM 或 Docker 容器中是隔离风险的唯一合理方案,尽管这比日常健身更简单,但实施起来仍显不便。
  • 亲历者提到 Claude 的 Memory 功能存在严重缺陷,常将不同对话上下文的无关信息错误关联,导致回答偏离当前任务。
  • 针对隐私泄露,有用户反驳称 Anthropic 切断 web_fetch 的翻页能力是治标不治本,且工具调用中直接暴露用户 Agent 信息反而增加了风险。
  • 部分开发者认为,由于大多数用户拥有 sudo 权限,单纯创建非特权用户账户无法有效防止 LLM 修改系统二进制文件,必须依赖容器化隔离。
  • 有观点批评安全社区对 LLM 漏洞的过度反应,认为人类在社交媒体上散布的疯狂言论造成的危害远大于 AI,却鲜少受到同等程度的问责。

同日更多故事

2026-07-15