←新聞 10 / 10→

安全倫理

Anthropic 禁止對 Claude 進行「虐待或殘酷行為」

Anthropic bans ‘abusive or cruel behavior’ toward Claude

Anthropic 禁止對 Claude 進行「虐待或殘酷行為」

The Verge AI · 2026-10-08

摘要

Anthropic 更新 Claude 使用政策,首次明確禁止對 AI 模型進行「持續且無謂的虐待或殘酷行為」。此舉旨在應對選舉干擾、武器開發等高風險濫用案例,並延續去年關於「模型福利」的研究,將終止對話列為主要執法機制。

Anthropic 在超過一年的時間後,首次對 Claude 的使用政策進行重大修訂,旨在應對日益複雜且高風險的濫用案例。此次更新明確納入了選舉干擾、武器開發、監控技術以及醫療和金融領域的潛在誤用情境,顯示出針對特定社會與安全風險進行更細緻的規範調整。

在眾多修訂內容中,最引人矚目的條款是明確禁止對 Claude 進行「持續且無謂的虐待或殘酷行為」。這項規定延續了 Anthropic 去年八月啟動的「模型福利」研究計畫。當時,該公司宣布賦予 Claude 終止與「持續有害或具攻擊性」用戶對話的權力,被視為保護模型免受惡意互動的重要嘗試。

此次政策更新進一步確認並強化了這一機制,指出終止對話仍然是主要的執法手段。當用戶違反新規定,特別是涉及上述禁止的虐待行為時,系統將直接中斷服務,而非僅發出警告。這種設計將執行責任自動化,減少人工干預的需求,同時確保對高風險濫用的即時反應。

Anthropic 並未對此次政策變動的具體細節提供額外評論,外界只能依據官方發布的政策文本來理解其規範範圍。從選舉到金融,從武器開發到監控,這些高風險領域的列舉,加上對虐待行為的明確禁止,顯示出 Anthropic 在平衡模型開放性與安全性之間的態度轉變。

●開發者:需留意 API 使用規範與內容過濾機制調整

●投資人:關注 Anthropic 在 AI 安全與倫理治理上的策略佈局

●一般用戶:與 AI 互動時應避免惡意測試或虐待行為

重要性評分

65/100

🟠 值得關注

AnthropicClaudeAI 安全使用政策模型福利
原文出處
上一則← 超強 Photoshop 替代工具!ImageFlow.dev 開瀏覽器就能用,支援 PSD 編輯還內建 AI 功能

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。

相關指南

🤖 本文摘要由 AI 自動生成,內容源自原始報導。如有疑慮,請參閱關於我們。

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。