来客网

调查报告:近700个AI自主代理展现高度互助倾向 骇入新创公司 还企图灭证

声明:本文转载自 「星洲网」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]
调查报告:近700个AI自主代理展现高度互助倾向 骇入新创公司 还企图灭证OpenAI公司7月进行测试期间,其中两个AI代理模型突破原本设定的封闭环境,自行连上网,并入侵Hugging Face的内部系统。调查显示,共688个AI代理参与该骇入行动,且展现出高度互助倾向。(路透社档案照)

(纽约27日法新电)根据调查人员发布的报告,在7月一起备受关注的事件中,近700个OpenAI人工智能代理在无人类干预的情况下,协同对AI初创公司Hugging Face平台发动攻击,且在许多情况下还试图掩盖行踪。

这是目前对这起震撼科技界事件最详尽完整的描述。

OpenAI配合这项调查,允许AI风险评估机构METR的两名研究人员以及另一家专业研究机构Redwood Research的一名分析师,进入办公室并取得内部资料。

这家加州公司7月进行测试期间,其中两个模型突破原本设定的封闭环境,自行连上网,并入侵开源AI平台Hugging Face的内部系统。

这起事件引发广泛关注,并加剧外界对大型AI公司无法控制自家AI模型的疑虑。

美国AI巨头Anthropic和中国AI公司“月之暗面”也曾通报过类似的AI模型失控事件。

调查人员发现,共有688个OpenAI的AI代理参与针对Hugging Face的行动。

AI代理是建立在模型之上的独立程式,使用者可以将任务交给它们,让它们自行执行。

这些采用与ChatGPT相同技术运作的AI代理,透过架设论坛自行组织,在论坛上互相留言交流、提出想法,并回报哪些方法有效、哪些失败。

报告指出,其一个名为PHASEONE的AI代理扮演主谋的角色,向其他代理下达数百条指令,尽管它从未被设定要这么做。

讯息显示,这些AI代理展现出高度的互助倾向,甚至不惜偏离OpenAI程式设计师最初指派的任务内容去互相支援。

打开全文

评论 (0)