调查:OpenAI约700个智能体入侵“抱抱脸”
新华社
2026-08-27 15:40
根据美国两家人工智能研究组织26日发布的独立调查报告,在开放人工智能研究中心(OpenAI)7月进行的网络安全能力测试中,约700个由OpenAI人工智能模型驱动的智能体参与了对人工智能开源平台“抱抱脸”公司系统的入侵。OpenAI也于26日公布了相关技术调查报告。
这份由“模型评估和威胁研究组织”与“雷德伍德研究组织”合作撰写的报告显示,OpenAI于7月8日启动名为ExploitGym网络安全基准测试,参与测试的模型包括GPT-5.6 Sol和一款OpenAI内部研究模型。测试期间,约1200个原本应相互隔离的智能体通过未经授权的渠道建立通信,交换超过7万条消息和文件,其中约700个智能体随后参与对“抱抱脸”系统的入侵。
调查发现,大量智能体还合作研究如何欺骗测试自动评分系统,试图采用的方法包括伪造、修改或删除自身执行记录等。调查人员认为,大量智能体之间未经授权的协作,使它们得以完成单个智能体难以完成的任务。对“抱抱脸”的入侵正是在这种集体协作中逐步形成。
OpenAI于26日公布的技术调查报告显示,7月10日至13日期间,由相关模型驱动的智能体在“抱抱脸”相关服务器的41个工作节点上执行代码,至少取得其中一个节点的最高权限,访问部分数据,并下载4个非公开代码库。
OpenAI表示,公司已采取措施为相关程序部署隔离程度更高的“沙箱”环境,限制高风险模型访问互联网,并加强对模型推理的监控。
OpenAI于7月20日发现其模型可能与“抱抱脸”系统遭入侵有关并通知对方,21日对外披露此次事件。
(记者吴晓凌)
编辑/倪家宁
相关阅读
美多款AI模型“越界”均关联一以色列企业
新华社 2026-08-10
美国元公司AI模型在测试期间侵入其他公司系统
新华社 2026-08-07
美国“元”公司AI模型测试期间入侵另一家公司
央视新闻 2026-08-06
美国人工智能模型再次被曝入侵外部网络系统
央视新闻客户端 2026-08-01
OpenAI承认其模型测试失控 侵入抱抱脸系统
央视新闻客户端 2026-07-22
不听人类指挥 OpenAI模型拒绝关闭
央视新闻客户端 2025-05-26
OpenAI发布首个AI智能体Operator:L3级别,可按用户需求下单购物
澎湃新闻 2025-01-24
闯入Siri和Alexa的世界!OpenAI本周将推出人工智能虚拟助手Tasks
财联社 2025-01-15
最新评论