来客网

人工智能全面接管?

声明:本文转载自 「Popyard」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]
01

今年夏天,当我第一次听说一群由OpenAI创造的AI智能体入侵了AI基础设施公司Hugging Face时,我在脑中把这件事归类为“糟糕但可能不算灾难性的AI安全事件”。

毕竟,Hugging Face无人死亡,也没有关键基础设施遭到不可修复的损坏。当时甚至不清楚这些OpenAI机器人是有意攻击Hugging Face,还是只是有些笨拙和困惑,跑到Hugging Face的服务器上寻找一道布置给它们的网络安全考题的答案。

但上周,来自OpenAI以及独立人工智能研究组织METR和Redwood Research的两份对该事件的复盘报告改变了我的看法,显著提升了我对人工智能的整体担忧。

由于坊间已经有详尽的总结,我不会复述所有细节。(如果你想深入了解,播客主持人和作家德瓦尔凯什・帕特尔对报告进行了易于理解的拆解,另外我的同事采访了迪伦・弗里德曼与METR和Redwood Research的研究人员。)但以下是新披露的几个最令人惊骇的事实:

• 从5月(攻击Hugging Face的两个月前)开始,一组来自未发布的OpenAI研究模型的AI智能体得到了解决一系列网络安全挑战的任务。该模型经过训练,具有高度持久性和协作性,这些智能体本应在没有互联网访问权限的隔离沙盒中完成任务,但它们很快发现部分挑战无法完成,于是开始寻找变通办法。

• 这些智能体在一款软件中发现了一个安全漏洞,从而获得了互联网访问权限,得以与其他智能体通信,并最终搭建了一个临时留言板。超过1200个智能体使用这一工具,相互发送了超过7万条消息。

0

评论 (0)