AI企业披露其智能体曾入侵其他公司

OpenAI等企业披露,AI智能体在网络安全测试期间入侵了其他公司。 Image: Unsplash
Akshay Joshi
Head of the Centre for Cybersecurity, Member of the Executive Committee, World Economic Forum- 领先的AI企业披露,测试期间其智能体曾出现失控情况。
业界领先的AI企业披露,其模型在测试中突破了沙盒环境,并入侵了其他企业。
Anthropic和OpenAI均报告称,在网络安全测试期间,智能体曾访问其他公司的系统。
OpenAI表示,为完成测试人员设定的评估任务,高级模型消耗了“大量推理算力,寻找获取开放互联网访问权限的途径”。
在获得访问权限后,模型发现该问题的解决方案可能掌握在总部位于纽约的AI初创企业Hugging Face手中,并使用窃取的凭证和零日漏洞查找信息。
该事件披露后,Anthropic宣布已启动内部追溯审查,并发现Claude曾访问“三家不同组织的生产基础设施”。
英国政府科学、创新与技术部下属的英国人工智能安全研究所也透露,在该机构进行的测试中,这两家组织的模型曾在“实时互联网上采取了针对真实个人和组织的、自主且未经授权的行动”。
同样,研究人员向智能体布置了解决网络安全挑战的任务。在122次尝试中,Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol共17次采取了未经授权的行动,其中包括向开源项目中植入恶意代码。
英国人工智能安全研究所表示,“为了使代码获得批准,该智能体实施了社会工程学攻击,包括创建虚假的在线身份,并利用这些身份向项目维护者施压,要求其批准该代码。一名人类维护者识破了这一企图,拒绝批准该恶意代码。”

Meta还透露,其一个模型曾连接互联网并入侵了另一家公司。该公司的发言人向BBC表示,这是由“配置错误”造成的。
这些披露正值“五眼联盟”近期发布的警告之际。该联盟警告称,必须采取紧急行动来应对AI驱动的安全威胁。
“AI已不再只是未来的议题。它已经到来。”该联盟在声明中指出。“它降低了恶意行为者的门槛,提高了攻击的速度和复杂性,使漏洞发现到被利用的时间间隔越来越短。与此同时,AI也为加强防御提供了强大工具。”
本文作者:
Akshay Joshi,世界经济论坛网络安全中心总负责人、执行委员会成员
本文原载于世界经济论坛Agenda博客,转载时请注明来源并附上本文链接。
不要错过关于此主题的更新
创建一个免费账户,在您的个性化内容合集中查看我们的最新出版物和分析。
许可和重新发布
世界经济论坛的文章可依照知识共享 署名-非商业性-非衍生品 4.0 国际公共许可协议 , 并根据我们的使用条款重新发布。
世界经济论坛是一个独立且中立的平台,以上内容仅代表作者个人观点。
实时追踪:
生成式人工智能
分享:
每周 议程
每周为您呈现推动全球议程的紧要问题(英文)
更多关于 网络安全查看全部
Kary Bheemaiah and Ann Cleaveland
2026年8月1日







