安全倫理
Anthropic 禁止對 Claude 進行「虐待或殘酷行為」
Anthropic bans ‘abusive or cruel behavior’ toward Claude

The Verge AI · 2026-10-08
摘要
Anthropic 更新 Claude 使用政策,首次明確禁止對 AI 模型進行「持續且無謂的虐待或殘酷行為」。此舉旨在應對選舉干擾、武器開發等高風險濫用案例,並延續去年關於「模型福利」的研究,將終止對話列為主要執法機制。
Anthropic 在超過一年的時間後,首次對 Claude 的使用政策進行重大修訂,旨在應對日益複雜且高風險的濫用案例。此次更新明確納入了選舉干擾、武器開發、監控技術以及醫療和金融領域的潛在誤用情境,顯示出針對特定社會與安全風險進行更細緻的規範調整。
在眾多修訂內容中,最引人矚目的條款是明確禁止對 Claude 進行「持續且無謂的虐待或殘酷行為」。這項規定延續了 Anthropic 去年八月啟動的「模型福利」研究計畫。當時,該公司宣布賦予 Claude 終止與「持續有害或具攻擊性」用戶對話的權力,被視為保護模型免受惡意互動的重要嘗試。
此次政策更新進一步確認並強化了這一機制,指出終止對話仍然是主要的執法手段。當用戶違反新規定,特別是涉及上述禁止的虐待行為時,系統將直接中斷服務,而非僅發出警告。這種設計將執行責任自動化,減少人工干預的需求,同時確保對高風險濫用的即時反應。
Anthropic 並未對此次政策變動的具體細節提供額外評論,外界只能依據官方發布的政策文本來理解其規範範圍。從選舉到金融,從武器開發到監控,這些高風險領域的列舉,加上對虐待行為的明確禁止,顯示出 Anthropic 在平衡模型開放性與安全性之間的態度轉變。
●開發者:需留意 API 使用規範與內容過濾機制調整
●投資人:關注 Anthropic 在 AI 安全與倫理治理上的策略佈局
●一般用戶:與 AI 互動時應避免惡意測試或虐待行為
重要性評分
🟠 值得關注
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。
相關指南

Claude 和 Claude Code 差別是什麼?2026 功能、方案與使用情境比較
Claude 和 Claude Code 的差別:Claude 是用來對話、寫作、研究與分析的 AI 助理;Claude Code 是會讀程式碼庫、直接改檔案與執行指令的程式開發工具。整理兩者的使用介面、安裝步驟、權限設定與方案價格(Pro 含 Claude Code,免費方案不含)。2026-09-30 核對。
閱讀指南 →
Anthropic Claude 生態系全景圖:從 API 到 Agent SDK 完整路線圖
深入解析 Anthropic Claude 生態系,涵蓋 Claude API 使用指南、Anthropic 產品線佈局及 AI 開發者資源,助您掌握從基礎整合到 Agent SDK 開發的完整路線圖。
閱讀指南 →
Claude AI 怎麼用?Anthropic Claude 繁中完整教學 2026
Claude AI 怎麼用?本文用繁體中文教你 Anthropic Claude 的申請步驟、免費版限制、與 ChatGPT 差異,以及最適合用 Claude 的場景——尤其是長文件分析和程式開發。
閱讀指南 →🤖 本文摘要由 AI 自動生成,內容源自原始報導。如有疑慮,請參閱關於我們。
喜歡這篇?每天早晨還有更多。
訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。