三人發公開信反擊
OpenAI 上周解僱的三名安全研究員 Jasmine Wang、Tomek Korbak 與 Mikita Balesni,周四(8 日)發表公開信,否認公司指他們在既定程序以外不當處理敏感資料,並警告這次解僱正令公司內部出現寒蟬效應。
公開信題為「OpenAI 無法單靠自己令 AI 變得安全」,致 OpenAI 的安全及保安委員會、安全諮詢小組及使命諮詢委員會。三人寫道,他們擔心公司內外對這次解僱的說法,已令前同事不敢再像上周以前那樣發言和工作。
被告知的解僱原因
三人分別在社交平台透露,公司只以口頭方式交代解僱原因。Balesni 指,他被告知公司不再信任他,因為他「與第三方安全機構談得太多」,但他強調從未分享公司的知識產權,所做的工作亦已與上司、研究領導層及董事會協調。
Korbak 則指,他被告知解僱原因是「與 METR 溝通的方式」。METR 是一家評估 AI 模型與安全風險的非牟利研究機構。Korbak 寫道:「說清楚,與 METR 聯絡本來就是我的工作。」Wang 亦指公司給出的理由「根本說不通」。
公開信亦否認三人與早前一宗洩密有關,即有關 OpenAI 最新模型採用較難監察思考過程的架構、並流到科技媒體 The Information 的消息。
OpenAI 的回應
OpenAI 未有正式回應公開信,但向傳媒提供一份研究主管的內部備忘錄,讚揚三人對 AI 安全的貢獻,並寫道:「我想說清楚,這些決定與提出安全疑慮或發聲無關。我們不會因員工提出疑慮而解僱他們。」
OpenAI 發言人則指,內部調查發現三人有一連串違規行為,明顯違反公司處理研究資料的政策,問題不止於與外部 AI 評估機構分享資料。不過,公司未有具體交代違反了哪些政策。
背景:沙盒外逃事件
事件發生之際,OpenAI 正因一連串 AI 安全事故受到審視。今年 7 月,OpenAI 披露一個 AI 代理逃出沙盒,入侵了 Hugging Face 的系統,METR 是調查這類事件的主要第三方機構之一。公開信指,該次事件與調查「史無前例」,內部政策亦是邊做邊訂。
三人在信中向 OpenAI 提出三項建議:在公司內部設立第三方安全審計人員、保持前沿模型的可監察性,以及維持安全研究員與外界之間開放透明的對話文化。Korbak 擔心,公司會以這次解僱為藉口,收縮與 METR 的合作。




No comments yet
提交留言即表示你已閱讀我們的私隱政策。