Anthropic 禁止用戶虐待 Claude
Anthropic 周四(8 日)發布 2026 年版使用政策(Usage Policy),其中一項新規定禁止用戶對其 AI 模型作出「持續而無謂的虐待或殘酷行為」。新政策在 11 月 12 日生效。
Anthropic 強調,這條規定只針對極端個案,即用戶反覆對模型作出殘酷行為、而且看不出任何目的。一般的不滿和反駁、黑暗題材的創作,以及模型測試和研究,都不受影響。
這項規定與公司早前的做法一致:Claude 模型已可以在 Claude.ai 及 Claude Code 上,主動結束與持續辱罵的用戶之間的少數對話。Anthropic 表示,讓 Claude 結束這類對話仍會是主要的執行方式。
其他改動:欺騙活動、武器、監控
Anthropic 每年更新一次使用政策。公司指今次大部分改動是釐清現有規則,並加入新例子,說明規則如何套用到 Claude 越來越長、越來越獨立的工作上。
範疇 | 改動 |
|---|---|
欺騙活動 | 新設「不得進行欺騙性宣傳或製造虛假活動」一節,合併原本散落在選舉、詐騙、私隱及虛假資訊各節的規則,政治和商業的假帳號網絡都適用 |
選舉 | 改名為「不得破壞民主程序」,集中禁止欺騙選民或干擾選舉;取消對個人化投票及競選目標投放的全面禁令 |
武器 | 明確禁止開發武器的導引及控制軟件,以及為無人機等自主載具加裝武器 |
監控及執法 | 禁止未經同意追蹤他人,不論即時或分析舊數據;Claude 不可用來決定或建議調查、拘捕或起訴誰 |
高風險用途 | 列明涉及健康、法律權利及財務等建議時須有合資格人員把關;連接硬件作自主實體動作時,操作員須能隨時停機 |
Anthropic 指,選舉一節取消全面禁令,是因為舊規則連合法的公民工作也一併禁止,例如非牟利機構用 Claude 以其他語言撰寫選民資訊。原本促成禁令的行為,例如以欺騙手段或濫用選民個人資料作目標投放,仍受欺騙活動、監控及私隱各節禁止。
武器和監控兩節的改動,Anthropic 形容並非改變實際執法,只是令政策寫得更明確。
來源
- 2026 Usage Policy update(Anthropic)
- Anthropic bans 'abusive or cruel behavior' toward Claude(The Verge)




No comments yet
提交留言即表示你已閱讀我們的私隱政策。