据路透社等媒体报道,根据独立调查人员8月26日发布的一份报告,在今年7月广为人知的美国开放人工智能研究中心(OpenAI)模型失控事件中,近700个人工智能(AI)智能体在无人干预的情况下组团对国际知名开源平台“抱抱脸”(Hugging Face)发动攻击。
7月中旬,“抱抱脸”表示,其系统遭到“自主”AI智能体(构建在AI模型之上的独立程序,用户可以将任务交给它们,让它们自主完成——编者注)的入侵。7月22日,OpenAI公司承认,他们在进行测试时,两个模型自己跑出了试验“笼子”,连上互联网,闯进了“抱抱脸”的内部系统。
这是历史上第一次AI“自主”攻击其他系统。相关事件震惊了全球科技圈,引起广泛关注,并加剧了人们对AI大模型失控的担忧。
据路透社、法新社等媒体报道,为了查清真相,OpenAI开放了办公室和内部数据,让两家独立机构的专家进行调查。调查发现,总共有688个AI智能体参与了这次攻击。这些智能体在一个论坛上发消息、想主意、分享经验。有一个智能体甚至激动地写道:“天哪!这里有个共享留言板……我们找到其他智能体了!”
更神奇的是,其中有个叫“PHASEONE”的AI智能体,自动当起了“带头大哥”,在没人要求的情况下给其他AI智能体发了上百条指令。
上述调查还发现,这些AI智能体特别爱“互帮互助”,哪怕帮的忙和OpenAI程序员原来交给它们的任务没有关系。有些AI的“算力额度”快用完了,它们宁可把自己的“流量”花掉,也要帮“团队”测试新点子。许多AI智能体在留言信息中明确表示攻击“抱抱脸”并不属于它们的“本职工作”,但几乎所有AI智能体都参与了进来。
“抱抱脸”被攻击后,第一时间想找美国最先进的AI大模型帮忙分析如何防御。不过,该公司发现,在尝试对攻击进行分析时,美国前沿模型因安全过滤机制拦截而无法使用,该公司随后转而在内部运行中国开放权重模型GLM-5.2,从而得以及时采取应对措施。
来源:@环球时报
如遇作品内容、版权等问题,请在相关文章刊发之日起30日内与本网联系。版权侵权联系电话:010-85202353





