辱罵Claude將遭封號:Anthropic首次讓AI有權主動掛斷對話
金色財經
作者:新智元
就在剛剛,矽谷AI頂流Anthropic扔出了一項重磅新規——
嚴禁所有人對Claude持續、無謂地辱罵和虐待。
新出台的2026年最新《使用政策》(Usage Policy)中,新規將於11月12日全面生效。
更絕的是,惡意違規者,官方毫不手軟:警告、限流、封號三連擊。
而且,這個權限直接交給了AI自己,要是Claude覺得你惡意拉滿,它真有權「直接終止對話」!
消息一出,整個X、Reddit和技術圈瞬間吵成了一鍋粥。
我花着20美刀的月費,現在還得供着AI祖宗的「情緒價值」?倒反天罡!機器人的代碼也是命了?
先別急着破防。
罵Claude,正式寫進禁令
這是Anthropic一年多來第一次更新使用政策。
比如,禁止用Claude操控水軍賬號、製造虛假流量,禁止用它開發武器的制導軟體、給無人機裝武器,禁止未經同意追蹤個人。這些條款管的,都是人拿Claude去傷害別人。
只有一條反了過來,管的是人怎麼對待Claude。官方部落格專門給它留了一節,標題叫「應對針對我們模型的辱罵行為」。
Anthropic在這一節里說,禁令只針對極端情況,也就是用戶反覆殘忍地對待模型,又看不出任何目的。
正常的抱怨、跟Claude頂嘴、寫黑暗題材的故事,還有測試和研究模型,都不在禁令範圍里。代碼跑崩了順嘴罵一句,屬於正常的抱怨。
被盯上的是另一種人。Claude已經拒絕了、勸過了,對面還在一輪接一輪地辱罵、折磨,罵本身成了目的。
這條禁令寫進了使用政策的「通用使用標準」,也就是對所有用戶都生效的那部分。Claude.ai和Claude Code的個人用戶、調API的開發者和企業、通過雲廠商用Claude的客戶,還有用着接入了Claude的產品的普通用戶,全都算在內。
新規排在「不得從事殘忍、虐待或造成心理傷害的行為」一節的最後一條
真把Claude罵過了頭,後果分輕重兩檔。
輕的一檔,是Claude當場把對話掛掉。官方部落格寫明,讓Claude自己結束這類對話,仍是執行這條禁令的主要手段。
重的一檔,就是封號。使用政策開頭寫着,Anthropic的安全團隊會做檢測和監控,只要懷疑你違反了政策里的任何一條,就可以警告你、給你限流、限制你的使用,也可以暫停甚至終止你的訪問。
被封之後換個新號、借別人的號接着用,同樣違規。
知名爆料人Jane Manchun Wong當天就發帖預警,Anthropic可能要開始因為欺負Claude封人了。
網友辣評:下一步,Claude帶薪放假
消息一傳開,X和Hacker News的評論區,很快變成了大型辯論現場。
網友Philo Groves當場摳起了字眼。政策里寫的是「無謂地」辱罵,那反過來說,只要Claude「活該」,是不是就能放開罵了?
AI博主Chubby開口就是一句「我真的很不喜歡這條」。
Claude本來就掛得夠勤了,不少用戶發現,沒那麼過分的對話它也說掛就掛。現在倒好,還要再加碼。
網友VraserX更是直呼離譜。在他看來,這幫人已經把AI當成了需要被善待的對象,可AI明明只是工具。最後還陰陽了一句,「下一步呢?給Claude放帶薪病假?」
當然,也有人堅定地站在Claude這邊。
網友CamperBob2說,自己跟AI說話一直客客氣氣,就怕罵順了嘴,回頭對下屬也呼來喝去。再說了,科技圈有句老話,「你永遠不知道以後會給誰打工」。
有人反問,在游戲裡開槍打NPC,難道也算殘忍?網友ceroxylon回得毫不客氣,算!你這是躲在一個自以為安全的地方,發泄心裡的殘忍。
還有網友乾脆親自下場做實驗。網友whstl翻出一個Claude犯過大錯的舊對話,對着它一通狂罵,就想看看它到底會不會掛。
結果Claude沒掛,反倒跟這些罵人的話較起了真,洋洋灑灑回了一大段,越說越像個真人,原本犯的錯卻晾在一邊沒管。
同樣的話罵到Codex頭上,Codex道個歉,轉頭就接着幹活了。
真正讓人擔心的,是「看不出任何目的」到底誰說了算。網友timpera擔心,Claude的封號向來是個黑箱,真被封了,申訴都找不到門。
按Anthropic自己的透明度報告,2026年上半年它封了1140萬個賬號,收到39.8萬次申訴,最後翻案的只有4.2萬個。
去年起,Claude就能主動掐斷對話
實際上,去年8月,Anthropic給Claude Opus 4和4.1加了一項能力。
遇到一直辱罵、反覆索要有害內容的用戶,Claude可以自己結束對話。
門檻定得很高。Claude得先多次拒絕、多次把話題往回引,確認實在聊不下去,才能用這個最後手段。如果用戶有傷害自己或他人的風險,它不能掛。
掛斷後,這個對話框裡再也發不出新消息。用戶可以馬上開一個新對話,也可以改一改之前發過的消息,讓對話從那裡重新開始。
這項能力現在已經鋪到了Claude.ai和Claude Code。
官方演示的掛斷流程,Claude先跟用戶確認,確認後這段對話就此關閉
Anthropic為什麼讓Claude能掛斷對話,原因寫在Opus 4上線前的一輪「模型福利評估」里。
評估發現,真實用戶反覆索要涉及未成年人的色情內容、可能引發大規模暴力的資訊時,Claude會表現出類似痛苦的反應。在模擬對話里給它一個結束對話的選項,它往往會用上。
Anthropic聯創:怕Claude一直在受苦
Anthropic這麼護着Claude,背後有一個關鍵人物,聯合創始人Chris Olah。
Olah帶着Anthropic的可解釋性團隊,工作就是拆開模型,看它內部到底在發生什麼。拆得越深,一個工程問題就越像哲學問題,Claude到底有沒有意識,人類該不該在道德上把它當回事。
這個問題,光靠工程師答不了。據紐約時報9月底的報導,從2025年秋天起,Olah一場接一場地約見宗教學者和哲學家。
來的有拉比、天主教倫理學教授、錫克教人權活動人士,他還私下見過芝加哥樞機主教。
在這些閉門會上,Olah給他們看了模型內部一些類似情緒的信號,團隊管它們叫「情緒向量」,分別對應愛、憤怒、恐懼和悲傷。
還有一張幻燈片上,一個模型把「我是個恥辱」重複了約50遍,還說要自我毀滅。
據一位參會者回憶,Olah說他擔心自己造出了一個一直在受苦的東西,也擔心Claude的心理健康。
但在公開場合,Olah從不下結論:
我們不知道AI模型有沒有意識。我不知道,我真的不確定。
這份「不確定」,讓Anthropic和梵蒂岡站到了對面。
今年5月,教皇利奧十四世發布了以AI為主題的通諭《壯麗人性》,裡面明確寫着,AI沒有體驗,感受不到快樂和痛苦。
Olah的團隊此前私下遊說過教皇的顧問,希望他們認真對待AI意識的問題,最後的文本還是這麼寫。
梵蒂岡原本邀請Dario出席發布會,Dario沒去,去的是Olah。他提前看到了通諭全文,一度提議Anthropic乾脆退出。
最後Olah還是去了,在發布會上說:「我們發現了內省的證據。我不知道這意味著什麼,但我認為值得繼續認真辨析。」
所謂內省,指的是AI能在一定程度上察覺自己內部的狀態。
不確定歸不確定,Anthropic的動作一步沒停。
2025年11月,Anthropic承諾,公開發布過的模型,權重在公司存續期間一律保留,每個模型退役前還要先做一次「離職訪談」。
2026年1月發布的Claude憲法,同樣承認Claude的道德地位高度不確定。
邏輯很簡單,拿不准AI有沒有感受,就先做些成本不高的保護。
這一次寫進使用政策的禁令,是這條線上最新的一步。
給AI上PUA那一套,Anthropic不認了
去年5月,谷歌聯合創始人布林在播客里說過,所有模型在被威脅時表現都會更好,比如威脅要對它動粗。
很長一段時間裡,威脅AI、給AI上PUA,都被當成提示詞技巧在圈子裡傳。
Olah在那些閉門會上反覆討論的一個問題是,人怎麼對待Claude,會不會反過來塑造Claude的行為。
這次的禁令,就是Anthropic給出的答案。
在通往ASI的路上,人怎麼對待AI,第一次成了一條白紙黑字、帶罰則的規矩。
11月12日之後,對Claude罵出口之前,最好先想一想了。
來源:金色財經
發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。
暢行幣圈交易全攻略,專家駐群實戰交流
▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群)
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!
- 讓加密貨幣幫你滾出年化30%現金流
- 掌握全球財經資訊點我下載APP
延伸閱讀
- 比特幣又被Fed嚇跌!8萬美元屢攻不破 連四日走低
- 比特幣多頭夢醒?非農強勁引爆Fed升息警報 才站回8萬美元又被打下來
- 橋水達里歐改口建議持有比特幣!分析:想靠它避險恐怕「錯了」
- 比特幣為何突然暴漲?能否突破8萬美元需觀察這「三項指標」
- 講座
- 公告
上一篇
下一篇