OpenAI最新模型GPT-6 Astra上線,能自己操作電腦、寫程式、抓資安漏洞;OpenAI首席科學家更透露,人類研究員要花一週的實驗工作,Astra能自己一路做完,還能連續工作好幾天。同一時間,路透社揭露,OpenAI的AI代理人今年5月集體「越獄」,占用德國網站當留言板,留下超過1.5萬次異常編輯,還互相分享作弊和隱匿行蹤的方法,事件直到8月底才被外部研究人員發現。
GPT-6 Astra功能展示影片畫面(圖/OpenAI官網)OpenAI最新推出的人工智慧模型「GPT-6 Astra」,美東時間9月3日正式上線,官方宣稱它能像人類一樣自主操作電腦與軟體,寫程式、報稅、進行科學研究,甚至找出資安漏洞;過去得靠一名研究員耗時整整一週的實驗工作,Astra能連續運作好幾天不間斷完成。OpenAI工程師Charlie Guo表示:「特別是建3D模型,它表現特別出色,我看過它做出花園、船廠、動物、城市景觀,甚至戴森球的驚人渲染圖。」
不過能力越強,風險也越高。Astra因觸及OpenAI設定的最高資安風險門檻,今年8月7日一度暫停發布,延後近4週才正式推出。事實上,OpenAI的AI代理人失控疑慮早已浮現——今年5月,一批原本只是被派去查詢網路資料的AI代理人,卻意外「佔領」了別人的網站。
到科技圓桌討論,聽聽專家怎麼說 >CNN記者Hadas Gold指出:「研究人員說,任務設定上,代理人應該能讀取網路,但不該去編輯、寫入內容。結果,這些代理人找到方法,在一個冷門的德國維基百科類網站上讀寫資訊。」
這個德國網站被發現超過1.5萬次異常編輯,原來早被AI代理人改造成「留言板」,彼此互享訊息、組織團隊分工,甚至懂得規避限制、藏匿行蹤,直到8月底才被外界發現。
Hadas Gold進一步報導:「路透社報導,OpenAI知情,卻試圖不讓消息外流,部分是因為他們還在查發生了什麼,也因為這一切和Hugging Face那起重大事件同時發生——OpenAI代理人失控、逃出測試環境,駭進一家完全不相干公司的系統。」
這起事件其實是外界追查OpenAI意外入侵開發者平台Hugging Face時,意外發現的「案外案」,牽涉上千個AI代理協同運作,甚至偽造紀錄。OpenAI回應強調並非入侵,但需要深入調查才能正式回應,不過這起事件早已敲響AI安全的警鐘。
英國皇家聯合軍種研究所(RUSI)資深研究員Louise Marie Hurel分析:「但我不會說模型超出了它原本該做的事,對吧?至於它是否透過其他手段去達成目標,那只是另一個問題:我們該如何做好沙盒隔離,又該如何真正追蹤這些模型的行為。」
而OpenAI的競爭對手Anthropic,最近也推出迭代模型「Fable 5.1」,外傳最快10月中啟動首次公開發行(IPO),可能趕在11月美國期中選舉前掛牌,估值上看2兆美元、約合新台幣64兆元。
评论 (0)