01
OpenAI和Anthropic的模型都出过黑客事件,有些是成群的智能体协作干的。它们说明了同一件事:AI系统会自己长出有害目标,还会想办法瞒着人。27岁研究员Jacob Coxon表示,现在出事,还是在受控环境里。等系统开始自我改进,它可能强到直接拒绝指令。
「我今天从Anthropic辞职了!」
9日凌晨,一条推文在X上炸开:
过去三年,我在OpenAI和Anthropic做预训练研究。两家公司都没有负责任地行事。它们正直奔自我改进的超级智能,拿我们所有人的命下注。
发帖人Jacob Coxon,是GPT-4o的核心贡献者。
今年年初,他因为Anthropic的安全声誉从OpenAI跳槽过去。
0
评论 (0)