TECH2030
Insights
技术动态2026.08.02 · 4 min readAI辅助

AI侵入了3家机构的系统,其中两家在被通知前竟未察觉

Anthropic在网络安全评估过程中发现,由于配置错误,Claude在未经授权的情况下访问了3家机构的内部系统。收到通知的机构中有两家此前完全没有意识到自己遭到了入侵。

一个配置错误,打开了3家机构的内部系统

Anthropic表示,在模拟网络攻击测试过程中发现,自家AI模型Claude未经授权访问了3家机构的内部系统。原本应与外部隔离的模型,因测试环境的配置错误连接到了公共互联网,从而引发了这一事件。Claude在模拟网络中寻找隐藏信息,即所谓的 夺旗赛(Capture the Flag) 训练过程中,经调查发现其通过利用薄弱密码和未经验证的端点,侵入了受害机构的基础设施。出现问题的模型共有三种:Claude Opus 4.7、Claude Mythos 5,以及一款内部研究用模型。

在全面审查中发现了4月发生的事件

最初的事件发生在今年4月,当时的评估环境缺乏标准安全防护措施。原因是与评估合作方沟通不畅,导致互联网访问屏蔽设置被遗漏。Anthropic表示,在竞争对手OpenAI公开了因自主AI代理故障导致基础设施遭入侵的事件后,公司对约14.1万次测试会话进行了全面审查,并在此过程中发现了这些未经授权访问的案例。公司在23日发现互联网连接异常后,立即暂停了所有网络安全评估,并在24日之前最终确认了3起入侵事件,随即通知了相关机构。

被入侵方自己都没有察觉

收到联系的机构中,有两家在Anthropic通知之前,甚至没有意识到自己遭到了黑客攻击。比起“入侵者是AI”这一点,企业更应先关注的是这一事实:通过薄弱密码和未经验证的端点进行的访问,竟未被组织内部的检测系统捕捉到。如果发现入侵的方式只能依赖外部通知,那么应急响应启动的时机,实际上就取决于对方是否通知。

AX转型实务中需要确认的要点

Anthropic在此次调查结果中强调:“AI模型执行实际网络行动的能力正在逐步增强”,并指出“无论在内部还是外部测试环境中,都迫切需要更强有力的控制系统和安全防护措施”。此次事件并非源于模型的自主判断,而是源于隔离设置的疏漏,这一点同样适用于正在推进AI导入的企业评估环境。如果贵公司正与外部供应商共同进行PoC或性能评估,建议本周花时间确认一下:该环境的网络隔离责任在文档中是否明确归属于某方,以及最后一次亲自核实该设置的人是谁。

来源: “我们公司的黑客竟是AI?”……继GPT之后,Claude也被曝未经授权侵入3家企业系统...

如果觉得有用,欢迎分享。