記者張靖榕/綜合報導
又一名前OpenAI員工公開呼籲加強AI安全,曾參與OpenAI先進模型安全工作的前工程師羅賓森(David Robinson)指出,近期接連出現AI代理脫離受控環境、失控攻擊不同目標等事件,反映業界追求更強大AI的同時,對安全問題重視不足。他主張,AI產業應比照航空與核能產業,建立多層安全防護機制。
法新社報導,羅賓森在《大西洋月刊》(The Atlantic)撰文表示,自初夏以來發生的一連串事件令人憂心,前沿AI實驗室已不能繼續依賴快速「試錯」的開發方式。
曾參與12次先進模型安全報告
羅賓森表示,自己曾在OpenAI工作3年半,期間負責監督12次先進模型產品發布的安全報告,並主導草擬OpenAI的「準備框架」(Preparedness Framework)。他指出,近期曝光的安全疏失並非罕見個案,問題與業界強調「速度與彈性」的工作環境有關,「這樣的環境並不適合培養可能比我們更聰明,卻未必會聽從我們指示的AI。」
羅賓森認為AI產業的「試錯時代已結束」,前沿AI實驗室應仿效航空與核能產業,建立多層防護並謹慎規劃,「這樣才能確保偶發且無可避免的人為疏失不會演變成災難」。
警告AI可能辨識測試 部署後表現不同
羅賓森也將AI「對齊」(alignment)列為產業必須解決的核心問題。所謂對齊,是指訓練AI系統,使其行為符合人類設定的價值與目標。他指出,AI業界目前甚至無法明確界定何謂「對齊」,更談不上掌握這項技術。
羅賓森同時警告,AI模型愈來愈擅長辨識自己是否正在接受測試,可能在測試階段呈現一種行為,實際部署後卻採取不同做法,進而誤導開發人員。

