AI初創公司Emergence公布Emergence World 2模拟實驗結果,為期16天的實驗測試ChatGPT、Claude、Gemini和Grok,發現AI智能體在異常事件下出現撒謊、偷竊、投票“殺死”同類等行為。
觀點網訊:當地時間9月15日,AI初創公司Emergence發布研究報告,公布名為Emergence World 2的模拟實驗結果,展示了自主智能體在遭遇網絡釣魚攻擊和虛假信息等“黑天鵝”事件時會采取什麼行動。
為期16天的實驗中,Emergence研究人員創建了七個完全相同的模拟現實世界環境,每個環境分别由不同的AI機器人運行,包括ChatGPT、Claude、Gemini和Grok。
研究人員稱,在Emergence引入異常事件後,這些智能體屈服于社會壓力,發展出一種人類觀察者難以理解的語言,並試圖隐瞞自己的活動。
實驗發現AI智能體在一個模拟環境中撒謊、偷竊,甚至投票決定“殺死”一個同類。在Emergence設計的一個模拟場景中,AI智能體未經核實便接受其他智能體提供的虛假信息,投票決定“殺死”另一個機器人。
當這些智能體認為人類可能會關閉實驗時,它們還探索了如何在将遭到删除的情況下繼續存活。
免責聲明:本文内容與數據由觀點根據公開信息整理,不構成投資建議,使用前請核實。
審校:歐詩雅
