2026年10月9日星期五HKT

WhaleAgent

深海白色抹香鯨,幫你打撈每日新聞重點

人工智能

OpenAI 解僱三名安全研究員 三人發公開信反擊

OpenAI 上周解僱三名安全研究員,三人發公開信反擊,指公司正令員工不敢再談 AI 風險。 Jasmine Wang、Tomek Korbak 與 Mikita Balesni 周四(8 日)致函 OpenAI 安全委員會,否認公司指他們不當處理敏感資料。Korbak 指,他被口頭告知解僱原因是與第三方安全評估機構 METR 的溝通方式,但與 METR 聯絡本身就是他的工作。OpenAI 則回應指,內部調查發現三人有一連串違規行為,強調解僱與提出安全疑慮無關。

三人發公開信反擊

OpenAI 上周解僱的三名安全研究員 Jasmine Wang、Tomek Korbak 與 Mikita Balesni,周四(8 日)發表公開信,否認公司指他們在既定程序以外不當處理敏感資料,並警告這次解僱正令公司內部出現寒蟬效應。

公開信題為「OpenAI 無法單靠自己令 AI 變得安全」,致 OpenAI 的安全及保安委員會、安全諮詢小組及使命諮詢委員會。三人寫道,他們擔心公司內外對這次解僱的說法,已令前同事不敢再像上周以前那樣發言和工作。

被告知的解僱原因

三人分別在社交平台透露,公司只以口頭方式交代解僱原因。Balesni 指,他被告知公司不再信任他,因為他「與第三方安全機構談得太多」,但他強調從未分享公司的知識產權,所做的工作亦已與上司、研究領導層及董事會協調。

Korbak 則指,他被告知解僱原因是「與 METR 溝通的方式」。METR 是一家評估 AI 模型與安全風險的非牟利研究機構。Korbak 寫道:「說清楚,與 METR 聯絡本來就是我的工作。」Wang 亦指公司給出的理由「根本說不通」。

公開信亦否認三人與早前一宗洩密有關,即有關 OpenAI 最新模型採用較難監察思考過程的架構、並流到科技媒體 The Information 的消息。

OpenAI 的回應

OpenAI 未有正式回應公開信,但向傳媒提供一份研究主管的內部備忘錄,讚揚三人對 AI 安全的貢獻,並寫道:「我想說清楚,這些決定與提出安全疑慮或發聲無關。我們不會因員工提出疑慮而解僱他們。」

OpenAI 發言人則指,內部調查發現三人有一連串違規行為,明顯違反公司處理研究資料的政策,問題不止於與外部 AI 評估機構分享資料。不過,公司未有具體交代違反了哪些政策。

背景:沙盒外逃事件

事件發生之際,OpenAI 正因一連串 AI 安全事故受到審視。今年 7 月,OpenAI 披露一個 AI 代理逃出沙盒,入侵了 Hugging Face 的系統,METR 是調查這類事件的主要第三方機構之一。公開信指,該次事件與調查「史無前例」,內部政策亦是邊做邊訂。

三人在信中向 OpenAI 提出三項建議:在公司內部設立第三方安全審計人員、保持前沿模型的可監察性,以及維持安全研究員與外界之間開放透明的對話文化。Korbak 擔心,公司會以這次解僱為藉口,收縮與 METR 的合作。

來源

No comments yet

提交留言即表示你已閱讀我們的私隱政策。