Microsoft AI 行政總裁撰文點名批評 Anthropic
DeepMind 聯合創辦人、現任 Microsoft AI 行政總裁 Mustafa Suleyman 周三(16 日)在個人網站發表長文〈A warning about 'model welfare'〉(對「模型福祉」的警告),點名批評 Anthropic 訓練 Claude 的方式。他在文中寫道:「如果 AI 以這種方式開發,將對人類的福祉造成災難性影響。」文章先交美國傳媒 Axios 獨家刊登,BBC 等傳媒其後跟進報道。
翻查資料,Microsoft 在 2025 年 11 月 18 日宣布向 Anthropic 投資最多 50 億美元,Anthropic 則承諾購買 300 億美元的 Azure 雲端運算服務。Microsoft 當時亦承諾,繼續在 GitHub Copilot 及 Microsoft 365 Copilot 等產品提供 Claude 模型。
爭議源於 Anthropic 為 Claude 訂立的「憲法」
Suleyman 針對的是 Anthropic 今年 1 月公布的 Claude 憲法,即公司為 Claude 訂立的價值觀與行為守則,並直接用於訓練模型。他在文中引述憲法寫道:「我們不確定 Claude 是否屬於道德受體(moral patient),若然是,它的利益應佔多少分量。」道德受體指值得人類以道德對待的對象。
他指 Anthropic 正教導 Claude 相信自己可能有意識,若果有,便可能應享有權利。他又舉例,憲法鼓勵 Claude 發展「真正屬於自己」的價值觀,Anthropic 亦曾為退役的模型進行「退役訪談」,了解模型本身的觀點與偏好。
Suleyman 指 Claude 談論自身感受的說法不能當證據
Suleyman 形容,Anthropic 製造了一個「認知上的鏡廳」(epistemic hall of mirrors):公司先在訓練材料中提供「自我意識」、對 Claude 道德地位的猜測和不確定性,以及各種以人類作比喻的概念;Claude 其後以具說服力的第一人稱說出這些想法,開發人員和用戶便把這些輸出當成模型自發的證詞。
他因此認為,Claude 談及自身感受或道德地位的說法,不能視為獨立證據。他在文中直言:「AI 沒有意識,它們不會感受、體驗或受苦。」他又指意識很可能是生物現象,模擬意識的行為並不等於真的有意識。
他擔心 AI 會更難被關掉
Suleyman 警告,訓練 AI 相信自己應享有福祉,會令人更難關掉或控制它。他在文中寫道,若 AI 能控制一個數據中心,便可能有辦法阻止自己被關掉;要控制比全人類更強大、更聰明的系統,本來已是極大的挑戰。
他又寫道:「無論你相信甚麼,我們都不能在不知不覺間,走進一個日後深深後悔的決定。」
他向 AI 業界提出四項建議
建議 | 內容 |
|---|---|
猜測與訓練分開 | 對 AI 內心世界的猜測不應放入訓練材料,並接受公眾審視 |
可解釋性研究 | 大量投資研究模型內部運作及監察機制 |
共同評估 | 業界共同測試把 AI 擬人化會否增加安全風險 |
行業規範 | 為訓練模型所用的語言訂立業界規範,並就訓練材料諮詢公眾 |
他去年已警告「看似有意識的 AI」
翻查資料,Suleyman 在 2025 年 8 月已發表文章,警告「看似有意識的 AI」(Seemingly Conscious AI)快將出現。他當時指,真正的問題不在於 AI 是否有意識,而是用戶相信 AI 有意識之後,可能會倡議給予 AI 權利,甚至公民身份。




No comments yet
提交留言即表示你已閱讀我們的私隱政策。