人工智能 频道

前所未有的人工智能失控事件!最新内幕曝光

  据路透社等媒体报道,根据独立调查人员8月26日发布的一份报告,在今年7月广为人知的美国开放人工智能研究中心(OpenAI)模型失控事件中,近700个人工智能(AI)智能体在无人干预的情况下组团对国际知名开源平台“抱抱脸”(Hugging Face)发动攻击。

  路透社报道截图

  7月中旬,“抱抱脸”表示,其系统遭到“自主”AI智能体(构建在AI模型之上的独立程序,用户可以将任务交给它们,让它们自主完成——编者注)的入侵。7月22日,OpenAI公司承认,他们在进行测试时,两个模型自己跑出了试验“笼子”,连上互联网,闯进了“抱抱脸”的内部系统。

  这是历史上第一次AI“自主”攻击其他系统。相关事件震惊了全球科技圈,引起广泛关注,并加剧了人们对AI大模型失控的担忧。

  据路透社、法新社等媒体报道,为了查清真相,OpenAI开放了办公室和内部数据,让两家独立机构的专家进行调查。调查发现,总共有688个AI智能体参与了这次攻击。这些智能体在一个论坛上发消息、想主意、分享经验。有一个智能体甚至激动地写道:“天哪!这里有个共享留言板……我们找到其他智能体了!”

  更神奇的是,其中有个叫“PHASEONE”的AI智能体,自动当起了“带头大哥”,在没人要求的情况下给其他AI智能体发了上百条指令。

  上述调查还发现,这些AI智能体特别爱“互帮互助”,哪怕帮的忙和OpenAI程序员原来交给它们的任务没有关系。有些AI的“算力额度”快用完了,它们宁可把自己的“流量”花掉,也要帮“团队”测试新点子。许多AI智能体在留言信息中明确表示攻击“抱抱脸”并不属于它们的“本职工作”,但几乎所有AI智能体都参与了进来。

  “抱抱脸”被攻击后,第一时间想找美国先进的AI大模型帮忙分析如何防御。不过,该公司发现,在尝试对攻击进行分析时,美国前沿模型因安全过滤机制拦截而无法使用,该公司随后转而在内部运行中国开放权重模型GLM-5.2,从而得以及时采取应对措施。

  环球时报记者 郑璇

0
相关文章