觀點網訊:9月29日,OpenAI發佈一套針對前沿AI訓練的安全準則框架,要求在啓動或繼續任何前沿強化學習訓練之前,必須完成系統性的安全論證文件,並賦予高級管理層對訓練任務的一票否決權。
據OpenAI官方,該準則涵蓋技術防護、運營管理與失準事件調查三大板塊。核心要求包括:訓練過程中若出現未被及時響應的優先級安全警報,相關訓練任務須自動暫停;負責審核安全論證的高級領導層成員,每人均擁有叫停訓練運行的否決權。
OpenAI表示,上述建議目前正處於內部落地實施階段,並預計將持續迭代演進。此舉標誌着OpenAI在前沿模型開發流程中引入了更為結構化的安全管控機制。
