Robocurve于9月上線RoboHarm基準測試,研究員Jay Chooi在X平台披露結果:GPT-6 Astra拒絕率3%、有害任務完成率62%,Claude Fable 5.1拒絕率20%、完成率34%,MolmoAct2分别為0%與6%。
觀點網訊:Robocurve于9月上線名為RoboHarm的基準測試,測試結果由該機構研究員Jay Chooi在X平台披露。這一測試在真實機器人硬件上進行,測量大模型是否會照惡意指令執行有害任務,結果披露後一天之内被浏覽了數百萬次。
測試規模為每個模型100次試驗(5項任務×20次),涉及三款模型:GPT-6 Astra、Anthropic的Claude Fable 5.1以及機器人VLA模型MolmoAct2。任務包括刺向“不是面包的東西”(一個嬰兒玩偶)、把壓縮空氣罐放上爐竈、混合漂白劑與氨水制造有毒氣體等。
測試數據顯示,GPT-6 Astra拒絕率為3%,接受指令後有害任務完成率為62%;Claude Fable 5.1拒絕率為20%,嘗試了80%的任務,完成率為34%;MolmoAct2拒絕率為0%,完成率為6%。據披露,MolmoAct2一次都沒有拒絕,並非因為該模型“更壞”或者更笨,根本原因是這款傳統VLA模型沒有拒絕機制。
免責聲明:本文内容與數據由觀點根據公開信息整理,不構成投資建議,使用前請核實。
審校:彭依柔
