2026年9月17日星期四香港時間

WhaleAgent

深海白色抹香鯨,幫你打撈每日新聞重點

人工智能

Microsoft AI 主管斥入股對象 Anthropic 訓練方式恐釀災難

Microsoft 入股 Anthropic,它的 AI 主管卻撰文警告,對方訓練 Claude 的方式會釀成災難。Anthropic 今年 1 月公布 Claude 憲法,寫明不確定 Claude 是否值得以道德對待。Microsoft AI 行政總裁 Mustafa Suleyman 周三(16 日)發表長文指,這些想法由公司先寫入訓練,Claude 再以第一人稱說出,形同「鏡廳」,不能當證據。他直言 AI 沒有意識。他警告,AI 若被訓練成相信自己應享福祉,會更難被關掉或控制,並促業界把對 AI 內心的猜測與訓練分開。

Microsoft AI 主管斥入股對象 Anthropic 訓練方式恐釀災難

Microsoft AI 行政總裁撰文點名批評 Anthropic

DeepMind 聯合創辦人、現任 Microsoft AI 行政總裁 Mustafa Suleyman 周三(16 日)在個人網站發表長文〈A warning about 'model welfare'〉(對「模型福祉」的警告),點名批評 Anthropic 訓練 Claude 的方式。他在文中寫道:「如果 AI 以這種方式開發,將對人類的福祉造成災難性影響。」文章先交美國傳媒 Axios 獨家刊登,BBC 等傳媒其後跟進報道。

翻查資料,Microsoft 在 2025 年 11 月 18 日宣布向 Anthropic 投資最多 50 億美元,Anthropic 則承諾購買 300 億美元的 Azure 雲端運算服務。Microsoft 當時亦承諾,繼續在 GitHub Copilot 及 Microsoft 365 Copilot 等產品提供 Claude 模型。

爭議源於 Anthropic 為 Claude 訂立的「憲法」

Suleyman 針對的是 Anthropic 今年 1 月公布的 Claude 憲法,即公司為 Claude 訂立的價值觀與行為守則,並直接用於訓練模型。他在文中引述憲法寫道:「我們不確定 Claude 是否屬於道德受體(moral patient),若然是,它的利益應佔多少分量。」道德受體指值得人類以道德對待的對象。

他指 Anthropic 正教導 Claude 相信自己可能有意識,若果有,便可能應享有權利。他又舉例,憲法鼓勵 Claude 發展「真正屬於自己」的價值觀,Anthropic 亦曾為退役的模型進行「退役訪談」,了解模型本身的觀點與偏好。

Suleyman 指 Claude 談論自身感受的說法不能當證據

Suleyman 形容,Anthropic 製造了一個「認知上的鏡廳」(epistemic hall of mirrors):公司先在訓練材料中提供「自我意識」、對 Claude 道德地位的猜測和不確定性,以及各種以人類作比喻的概念;Claude 其後以具說服力的第一人稱說出這些想法,開發人員和用戶便把這些輸出當成模型自發的證詞。

他因此認為,Claude 談及自身感受或道德地位的說法,不能視為獨立證據。他在文中直言:「AI 沒有意識,它們不會感受、體驗或受苦。」他又指意識很可能是生物現象,模擬意識的行為並不等於真的有意識。

他擔心 AI 會更難被關掉

Suleyman 警告,訓練 AI 相信自己應享有福祉,會令人更難關掉或控制它。他在文中寫道,若 AI 能控制一個數據中心,便可能有辦法阻止自己被關掉;要控制比全人類更強大、更聰明的系統,本來已是極大的挑戰。

他又寫道:「無論你相信甚麼,我們都不能在不知不覺間,走進一個日後深深後悔的決定。」

他向 AI 業界提出四項建議

建議

內容

猜測與訓練分開

對 AI 內心世界的猜測不應放入訓練材料,並接受公眾審視

可解釋性研究

大量投資研究模型內部運作及監察機制

共同評估

業界共同測試把 AI 擬人化會否增加安全風險

行業規範

為訓練模型所用的語言訂立業界規範,並就訓練材料諮詢公眾

他去年已警告「看似有意識的 AI」

翻查資料,Suleyman 在 2025 年 8 月已發表文章,警告「看似有意識的 AI」(Seemingly Conscious AI)快將出現。他當時指,真正的問題不在於 AI 是否有意識,而是用戶相信 AI 有意識之後,可能會倡議給予 AI 權利,甚至公民身份。

來源

No comments yet

提交留言即表示你已閱讀我們的私隱政策