罵AI也犯規?Anthropic新政策禁止用戶「無端虐待」Claude

2026 年 10 月 9 日

人工智能聊天機械人Claude的開發商Anthropic更新使用政策,禁止用戶對其模型作出「持續且無必要的虐待或殘酷行為」。與此同時,公司高層仍在探討機器意識的問題。

本文核心內容:
· 關鍵實體:Anthropic、OpenAI
· 關鍵人物:Anthropic行政總裁阿莫迪、OpenAI行政總裁奧特曼
· 政策重點:禁止「持續且無必要的虐待或殘酷行為」
· 豁免範圍:一般用戶不滿、模型測試及「黑暗創作題材」

Anthropic新政策禁止甚麼行為?

科技網站The Verge最先報道這項政策改動。總部位於三藩市的Anthropic在網上使用政策中指出,禁令不適用於用戶常見的不滿情緒、模型測試或「黑暗創作題材」。Anthropic的使用政策過往已有限制虐待行為的條款。

Anthropic發言人未有即時回應查詢,說明何種行為會被視為「虐待或殘酷」。

Claude為何可以結束對話?

Anthropic的大型語言模型具備在用戶持續作出有害行為時結束對話的功能。公司去年8月推出這項功能時,將其定位為保障人工智能福祉的措施。

Anthropic網站寫道:「我們對Claude及其他大型語言模型現在或將來的潛在道德地位仍非常不確定。不過,我們認真看待這個問題,並在研究計劃之外,致力找出及推行低成本的干預措施,以防萬一模型福祉存在時降低相關風險。讓模型結束或退出可能令其困擾的互動,就是其中一項措施。」

AI是否有意識?兩大AI公司立場如何?

人工智能是否具有意識,在科技界內外都極具爭議。Anthropic行政總裁阿莫迪(Dario Amodei)曾表示,他無法排除這個可能性。

競爭對手OpenAI的行政總裁奧特曼(Sam Altman)則似乎抗拒這種觀點。《紐約時報》報道Anthropic高層曾與宗教學者進行大量對話後數天,奧特曼在X發文說:「有人試圖賦予人工智能模型宗教力量,或將人類判斷交給它們,令我非常不安,我認為這是一個真正的安全問題。」

來源:《衛報》(The Guardian)

封面來源:Adobe Stock