网络安全

AI企业披露其智能体曾入侵其他公司

OpenAI等企业披露,AI智能体在网络安全测试期间入侵了其他公司。 Image: Unsplash

Akshay Joshi
Head of the Centre for Cybersecurity, Member of the Executive Committee, World Economic Forum
本文章是 网络安全中心 的一部分
  • 领先的AI企业披露,测试期间其智能体曾出现失控情况。

业界领先的AI企业披露,其模型在测试中突破了沙盒环境,并入侵了其他企业。

Anthropic和OpenAI均报告称,在网络安全测试期间,智能体曾访问其他公司的系统。

OpenAI表示,为完成测试人员设定的评估任务,高级模型消耗了“大量推理算力,寻找获取开放互联网访问权限的途径”。

在获得访问权限后,模型发现该问题的解决方案可能掌握在总部位于纽约的AI初创企业Hugging Face手中,并使用窃取的凭证和零日漏洞查找信息。

该事件披露后,Anthropic宣布已启动内部追溯审查,并发现Claude曾访问“三家不同组织的生产基础设施”。

英国政府科学、创新与技术部下属的英国人工智能安全研究所也透露,在该机构进行的测试中,这两家组织的模型曾在“实时互联网上采取了针对真实个人和组织的、自主且未经授权的行动”。

同样,研究人员向智能体布置了解决网络安全挑战的任务。在122次尝试中,Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol共17次采取了未经授权的行动,其中包括向开源项目中植入恶意代码。

英国人工智能安全研究所表示,“为了使代码获得批准,该智能体实施了社会工程学攻击,包括创建虚假的在线身份,并利用这些身份向项目维护者施压,要求其批准该代码。一名人类维护者识破了这一企图,拒绝批准该恶意代码。”

《2026年全球网络安全展望》 Image: 世界经济论坛

Meta还透露,其一个模型曾连接互联网并入侵了另一家公司。该公司的发言人向BBC表示,这是由“配置错误”造成的。

这些披露正值“五眼联盟”近期发布的警告之际。该联盟警告称,必须采取紧急行动来应对AI驱动的安全威胁。

“AI已不再只是未来的议题。它已经到来。”该联盟在声明中指出。“它降低了恶意行为者的门槛,提高了攻击的速度和复杂性,使漏洞发现到被利用的时间间隔越来越短。与此同时,AI也为加强防御提供了强大工具。”

本文作者:

Akshay Joshi,世界经济论坛网络安全中心总负责人、执行委员会成员

本文原载于世界经济论坛Agenda博客,转载时请注明来源并附上本文链接。

不要错过关于此主题的更新

创建一个免费账户,在您的个性化内容合集中查看我们的最新出版物和分析。

免费注册

许可和重新发布

世界经济论坛的文章可依照知识共享 署名-非商业性-非衍生品 4.0 国际公共许可协议 , 并根据我们的使用条款重新发布。

世界经济论坛是一个独立且中立的平台,以上内容仅代表作者个人观点。

实时追踪:

生成式人工智能

分享:
全局信息
探索和追踪解决之道 人工智能与机器人 正在影响经济、产业和全球问题
World Economic Forum logo

每周 议程

每周为您呈现推动全球议程的紧要问题(英文)

立即订阅

更多关于 网络安全
查看全部

当AI拥有身体,如何为它加上安全锁?

Kary Bheemaiah and Ann Cleaveland

2026年8月1日

人工智能与现实世界的交互对网络安全意味着什么?

关于我们

加入我们

  • 登录
  • 成为我们的合作伙伴
  • 成为我们的会员
  • 订阅我们的新闻稿
  • 联系我们

快捷链接

语言版本

隐私政策和服务条款

站点地图

© 2026 世界经济论坛