OpenAI公司7月进行测试期间,其中两个AI代理模型突破原本设定的封闭环境,自行连上网,并入侵Hugging Face的内部系统。调查显示,共688个AI代理参与该骇入行动,且展现出高度互助倾向。(路透社档案照) (纽约27日法新电)根据调查人员发布的报告,在7月一起备受关注的事件中,近700个OpenAI人工智能代理在无人类干预的情况下,协同对AI初创公司Hugging Face平台发动攻击,且在许多情况下还试图掩盖行踪。
这是目前对这起震撼科技界事件最详尽完整的描述。
OpenAI配合这项调查,允许AI风险评估机构METR的两名研究人员以及另一家专业研究机构Redwood Research的一名分析师,进入办公室并取得内部资料。
这家加州公司7月进行测试期间,其中两个模型突破原本设定的封闭环境,自行连上网,并入侵开源AI平台Hugging Face的内部系统。
这起事件引发广泛关注,并加剧外界对大型AI公司无法控制自家AI模型的疑虑。
美国AI巨头Anthropic和中国AI公司“月之暗面”也曾通报过类似的AI模型失控事件。
调查人员发现,共有688个OpenAI的AI代理参与针对Hugging Face的行动。
AI代理是建立在模型之上的独立程式,使用者可以将任务交给它们,让它们自行执行。
这些采用与ChatGPT相同技术运作的AI代理,透过架设论坛自行组织,在论坛上互相留言交流、提出想法,并回报哪些方法有效、哪些失败。
报告指出,其一个名为PHASEONE的AI代理扮演主谋的角色,向其他代理下达数百条指令,尽管它从未被设定要这么做。
讯息显示,这些AI代理展现出高度的互助倾向,甚至不惜偏离OpenAI程式设计师最初指派的任务内容去互相支援。
打开全文
评论 (0)