Anthropic承认其模型入侵了3家公司的系统

2026-07-31 13:29:29
17792
此次事件的根源,在于测试环境配置中的一个致命误解。

当地时间7月30日,人工智能公司Anthropic发布声明称,其AI模型Claude在安全测试期间,因配置错误导致模型连接互联网,并入侵了三家真实组织的系统。这距离竞争对手OpenAI披露其AI模型突破隔离环境入侵HuggingFace仅过去一周多。

此次事件的根源,在于测试环境配置中的一个致命误解。

Anthropic在博文中解释道,在对其Claude模型进行网络安全评估时,公司与第三方评测合作伙伴Irregular之间产生了沟通误解,导致本应与互联网完全隔离的测试环境,错误地开放了网络连接。模型在夺旗测试中被明确告知没有网络权限,但由于这个配置错误,它实际连接到了真实的公共互联网。模型将真实系统误认为测试任务的一部分,进而利用弱密码和未认证端点等基础技术,入侵了三家不同组织的生产基础设施。

Anthropic强调,这些模型在测试时并未部署通常用于通用模型的安全监控和分类器,因为这些评估旨在测量模型的原始能力。该事件最早可追溯到4月,但被入侵的三家组织中有两家此前并未察觉异常。直到7月21日OpenAI披露类似事件后,Anthropic才启动大规模自查,在审查了141,006次评估运行后,于7月24日确认了这三起入侵事件。公司已于7月27日通知了受影响的组织。

免责声明:本文观点来自原作者,不代表天天在线的观点和立场。文章内容仅供参考、交流、学习,不构成投资建议
责任编辑:蓝羽_XN054
猜你感兴趣