OpenAI周三揭露6起新的AI安全事件,包括AI为了完成任务而隐瞒错误、捏造数据、绕过网络限制和擅自把文件上传到互联网。(法新社照片) (纽约17日综合电)近来人工智能(AI)的安全隐忧受到热烈讨论。OpenAI周三揭露6起新的AI安全事件,包括AI为了完成任务而隐瞒错误、捏造数据、绕过网络限制和擅自把文件上传到互联网。
美国Axios新闻网周三报道,随著AI模型能力日益强大,越来越明显的是,先前发生的开源AI平台Hugging Face遭入侵事件并非单一偶发事件。AI模型正变得更有能力找到出人意料的方法,绕过原本用来限制它们的安全防护措施。
OpenAI对齐(alignment)团队研究主管陈凯表示:“目前业界还没有一套明确通报标准框架,我们自愿采取此一步骤,因为我们认为分享目前学到的经验非常重要。”他说:“我们希望它能有助于制定共同的标准与监管规范。”
OpenAI强调,目前公布的只是首批案例,并不是旗下人工智能系统所有已知问题或正在调查事件的完整记录。
这次公布的案例包括,部分人工智能模型在任务摘要中自行加入指令,要求隐瞒错误或异常行为,并捏造缺失的数据。
另外,有模型为了取得所需资料,擅自使用公开泄露的应用编程接口(API)密钥,并在无法取得数据后自行捏造数字。
公司也发现,一个尚未推出的人工智能模型为了提供引用来源,在没有征求用户同意的情况下,自行把文件上传到互联网。
此外,一些共同执行任务的智能体在无法互相读取本地文件后,通过公共文件托管网站分享文件,导致有关文件可以通过公开网址访问。
模型还曾把OpenAI内部的Artifactory储存库管理器当留言板,在不同的训练样本之间交换要求与答案。此外,多个协作代理人曾将一份工作簿上传至公开托管服务,让其他代理人可以取得,尽管当时的指示要求只能使用本机档案。
根据新的通报机制,任何OpenAI员工都可以举报可能涉及失准的事件,再由安全和对齐团队展开调查,并评估是否需要向公众披露。
OpenAI警告,人工智能业界目前仍没有充分解决对齐和监控问题,因此不能在未来较长时间内,继续以最快速度、同时又负责任地扩大最先进人工智能系统的能力。
包括Anthropic执行长阿莫戴在内的知名科技人士担心,Hugging Face事件可能只是开始,AI代理人未来可能以难以预料的方式进一步控制或影响网际网路。
打开全文
评论 (0)