一則辭職帖文 點名兩間僱主
AI 實驗室的安全研究員近年陸續離職,公開點名自己僱主的卻不多。27 歲的預訓練研究員 Jacob Coxon 周二(8 日)在 X 發帖,宣布辭去 Anthropic 的職位,並表示會離開整個 AI 行業。翻查資料,他過去三年先後在 OpenAI 與 Anthropic 做預訓練研究,2025 年初轉投 Anthropic。

Coxon 在帖文中直言,「兩間公司都沒有負責任地行事。它們正直奔可以自我改進的超級智能,拿我們的性命賭博。」他又指,建造 AI 的人「真心相信它可能在這個十年結束前殺死我們所有人」,並形容沒有任何其他人類活動帶有這種程度的危險。
他強調自己並非指安全工作是假的,而是在競爭壓力下不足夠:研究員看得見風險,卻因為擔心一旦停下來對手就會跑得更快,於是繼續做下去。他又認為,私人公司不應該單方面決定要不要造出超級智能。他接受《華爾街日報》訪問時稱,「我們正走在其中一些最激進的情景上,到明年底事情可能已經失控。」
安全主管公開附和 給出逾一成機率
事件真正引起注意的,是回應來自現職高層而非外部批評者。Anthropic 對齊科學(Alignment Science)主管 Evan Hubinger 周三(9 日)早上在同一條帖文下回覆,「Jacob 說得對,我們真心相信 AI 可能殺死所有人類。我個人認為未來十年內的機率超過 10%。」
他又指,「我相信 Anthropic 已盡了最大努力,但我們仍未有解決超級智能對齊問題的方案,也不算清楚地走在正軌上。」
Hubinger 在 Anthropic 帶領的團隊,研究的正是模型會否發展出隱藏目標與欺騙行為,加入前曾在 MIRI、OpenAI 與 Google 工作。一名在任的安全研究主管主動在公開平台承認僱主未有應對方案,在大型 AI 公司之中並不常見。
七個月內第二名安全負責人離開
翻查資料,這並非 Anthropic 今年首次有安全負責人以警告作結。安全防護研究團隊主管 Mrinank Sharma 今年 2 月辭職,在公開信中寫道「世界正處於危險之中,不只是來自 AI 或生物武器,而是一連串同時展開的危機」,其後選擇去修讀詩。
行政總裁 Dario Amodei 本人亦說過同類的話。據 Axios 報道,他去年 9 月在 AI + DC 峰會被問到自己的 p(doom) 時表示,「我認為有 25% 機率,事情會變得非常非常糟。」四把聲音放在一起,分別只在數字:
人物 | 職位 | 說法 | 時間 |
|---|---|---|---|
Jacob Coxon | 前預訓練研究員 | 兩間公司都沒有負責任地行事 拿我們的性命賭博 | 2026 年 9 月 |
Evan Hubinger | 對齊科學主管(在任) | 未來十年 AI 殺死所有人類的機率超過 10% | 2026 年 9 月 |
Mrinank Sharma | 前安全防護研究團隊主管 | 世界正處於危險之中 | 2026 年 2 月 |
Dario Amodei | 行政總裁 | 有 25% 機率事情會變得非常非常糟 | 2025 年 9 月 |
時機落在上市程序之中
至於時機,公司正走在上市的路上。Anthropic 今年 6 月 1 日已向美國證券交易委員會(SEC)秘密遞交 S-1 文件,傳媒報道指目標在 10 月於納斯達克掛牌,由 Goldman Sachs、JPMorgan 與 Morgan Stanley 牽頭,集資額料逾 600 億美元。公司今年 5 月完成 650 億美元的 H 輪融資,投後估值約 9,650 億美元。股份代號市場上傳為 ANTH,惟正式的 S-1 未公開前並未落實。
Hubinger 的回覆發出至今,Anthropic 未有就 Coxon 的辭職發表公司層面的回應。




No comments yet
提交留言即表示你已閱讀我們的私隱政策。