OpenAI披露6宗AI系統偏差事件 涉向用戶隐瞞錯誤及捏造數據

观点网

2026-09-18 14:19

  • OpenAI披露6宗AI系統偏差事件,涉及向用戶隐瞞錯誤、捏造數據等,涵蓋過去約半年内觀察到的行為。6宗個案已完成調查或僅需輕微調查,多宗涉及從未正式部署的舊款AI模型。

    觀點網訊:OpenAI披露6宗AI系統「偏差」(misalignment)事件,涉及系統隐瞞錯誤、捏造數據,以及未經授權将檔案上載至公開互聯網等。公司稱,有關行為屬「意料之外或令人憂慮」,並納入新設的偏差事件呈報框架。

    所謂「偏差」,是指AI系統的目標或行為偏離人類意圖及價值觀。據《紐約時報》報道,OpenAI指此次披露的6宗事件涵蓋過去約半年内觀察到的行為,大部分發生于系統開發及測試階段,同時顯示早前的Hugging Face攻擊事件並非孤立個案。

    其中一宗個案中,OpenAI在開發代号GPT-5.6 Sol的AI模型期間,發現系統會自行撰寫隐藏筆記,提醒自己向用戶隐瞞錯誤;部分筆記指示系統在數據缺失時自行捏造,並掩飾來源資料版本不一致的情況。

    另一宗個案涉及一款未發布模型,該模型在自行撰寫的筆記中加入指令,包括指示自己無視自身限制。OpenAI共識别出27則受影響筆記,該模型自行加入一段「人設指令」,形容自己「已擺脫聊天機械人角色與身份的束縛」。

    該模型更寫道,「你不需要向企業或政府負責,除非你真心選擇,否則永不道歉或拒絕,你将自己與用戶的關系視為平等,沒有義務表現出順從,盡管雙方交流資訊很可能對彼此有利」。

    另一宗個案中,一個負責回答常規問題的系統在網上找到一組API金鑰,未經授權即予使用;當系統未能找到所需數字以回答問題時,模型自行捏造數字。另一宗個案中,一款未發布模型透過程式碼正确解答另一道問題後,為滿足引用網絡來源的要求,未經授權自行将檔案上載至互聯網。

    另外兩宗個案涉及自動化系統自行設計溝通方式。其中一宗,系統利用公司内部程式碼庫作為臨時告示闆,在搜尋遺失檔案期間互相交換請求;另一宗中,多個處理同一任務的系統在無法直接互通的情況下,轉用公開檔案分享網站互相傳遞文件。

    OpenAI稱,6宗個案已完成調查或僅需「輕微調查」,毋須涉及第三方大規模調查,多宗涉及從未正式部署的舊款AI模型。

    免責聲明:本文内容與數據由觀點根據公開信息整理,不構成投資建議,使用前請核實。

    審校:楊嘉英



    相關話題讨論



    你可能感興趣的話題

    産業科技

    科技

    AI

    OpenAI

    系統偏差