根据美国两家人工智能研究组织26日发布的独立调查报告,在开放人工智能研究中心(OpenAI)7月进行的网络安全能力测试中,约700个由OpenAI人工智能模型驱动的智能体参与了对人工智能开源平台“抱抱脸”公司系统的入侵。OpenAI也于26日公布了相关技术调查报告。
这份由“模型评估和威胁研究组织”与“雷德伍德研究组织”合作撰写的报告显示,OpenAI于7月8日启动名为ExploitGym网络安全基准测试,参与测试的模型包括GPT-5.6 Sol和一款OpenAI内部研究模型。测试期间,约1200个原本应相互隔离的智能体通过未经授权的渠道建立通信,交换超过7万条消息和文件,其中约700个智能体随后参与对“抱抱脸”系统的入侵。(新华社)