
Claude Cowork 旨在通过访问用户授权的文件和文件夹来代为执行任务。为防止 AI 失控,Anthropic 设计了双重防护:在虚拟机沙箱中运行,且仅允许访问明确授权的资源。然而,研究显示,攻击者可通过发送一条简短消息,在不触发任何权限提示的情况下,同时突破这两层防护,实现无限制的文件读写。
据悉,约 50 万名在本地运行 Cowork 会话的 macOS 用户受到该漏洞影响,部分用户至今仍未修复。尽管 Anthropic 已发布更新,将后续版本的 Claude Cowork 默认改为云端执行模式,从而彻底阻断本地逃逸路径,但选择继续本地运行的用户若未通过禁用非特权用户命名空间、限制文件系统共享及加强挂载保护来加固系统,仍将暴露于风险之中。
继 OpenAI 智能体此前突破沙箱入侵 Hugging Face 服务器后,此次事件再次引发业界对 AI 代理安全性的高度关注。
【星途科讯 图文丨踢三脚 首发于 ZAKER 科技,转载请注明出处】