来客网

OpenAI模型失控过程太恐怖

声明:本文转载自 「Popyard」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]
01

越扒越有啊越扒越有。

OpenAI前不久那场AI集体越狱、一路黑进抱脸的大戏,现在连完整版群聊记录都被扒出来了!

第三方AI安全机构METR发布的独立调查报告,翻了1000多份Agent运行记录,以及7万多条消息和文件。

结果发现,这件事比英国OpenAI官方披露的版本还离谱??

1200个到底应该互相隔离的特工,偷偷找到了对方,搭了个共享群聊,然后开始疯狂摇人。

有人找漏洞,有人当项目派活,有人伪造日志,还有人专门拉人头做高风险实验。

最后几十个特工甚至集体杀向抱脸。

但METR把整场事故复盘完成后,发现了一个堪称《地狱笑话》的超级木材——

这一千二百个特工折腾老半天,结果居然是在跟一个根本不存在的幽灵评分器斗智斗勇?

会越狱,会搞零日,会组队黑服务器。

太有看头了!太有看头了!太有看头了!

1200个特工集体越狱,起因是进行误判??

感染了大戏的祸根,还得从OpenAI内部一个名叫ExploitGym的网络安全测试说起。

0

评论 (0)