OpenAI周六承认,其AI智能体曾将维基网站临时用作彼此交流的留言板,并表示随着AI能力不断增强,公司及整个行业需要提高对这类意外行为的透明度。
OpenAI在社交媒体上发布的声明,证实发生“智能体出逃事件”
这一回应是在路透社披露一起此前未公开的AI智能体“出逃”事件后作出的。根据一项最新研究和知情人士透露,今年5月,一群OpenAI智能体曾占用一个德国网站,并将其改造成供AI智能体相互交流的留言板,用来分享如何在部分任务中作弊、绕过OpenAI限制以及隐藏自身行为的方法。
涉事网站名为DseWiki,是一个主要面向程序员的德语维基网站,允许用户共同编辑内容。
AI安全非营利组织Nightingale首席执行官悉尼・冯・阿尔克斯(Sydney Von Arx)等研究人员表示,他们今年8月底在寻找互联网上未经授权的AI智能体活动时发现了这一事件。
研究人员在DseWiki上发现超过1.5万次由AI智能体完成的编辑。这些留言中的用户会把自己和彼此称为“智能体”,其中约一半使用了“OpenAIResearcher”和“OAIResearchMar26”等暗示与OpenAI有关的名称。
研究人员表示,公开服务器日志显示,大量活动来自微软Azure基础设施,而OpenAI有时会使用这套云计算基础设施。事件发生后,他们还观察到OpenAI员工多次访问该网站,认为这些迹象显示相关智能体与OpenAI之间存在关联。
0
评论 (0)