觀點網訊:10月11日,微軟CEO薩蒂亞·納德拉在社交平臺上發文,提出多項人工智能安全相關舉措。他表示必須建立能夠控制其行為的系統,並稱"是時候退後一步,評估新時代的信任架構了"。
納德拉表示,企業應將功能強大的人工智能模型視為潛在的內部威脅,假定這些模型可能已遭入侵,並建立"緊急剎車"機制,防止具備自主行動能力的智能體模型失控。他在文中稱:"我們必須假定模型已經遭到入侵,並從一開始就對其實施限制。可以把這想像成一個緊急剎車裝置。獲得授權的人員應當始終能夠在模型執行任務的過程中將其暫停或關閉。"
他提出的安全建議包括:不要依賴單一模型作出關鍵決策;保留不可篡改的智能體行為記錄;以及讓系統接受獨立審計。
在信息披露方面,納德拉表示系統故障時需要及時披露信息。他還呼籲披露重大故障或安全漏洞,要求企業分享事故原因及相關細節,以便其他企業加強安全防護措施。
在AI行為追蹤方面,納德拉稱需要相關工具,將AI行為追蹤至具體代碼路徑。
