导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

Anthropic新规禁止辱骂Claude:AI可主动终止对话,违规者或遭封号

导语:硅谷AI公司Anthropic近日发布2026年最新《使用政策》,新规将于11月12日全面生效。政策明确禁止对Claude持续、无谓地辱骂和虐待,并首次将主动终止对话的权限交给AI。若Claude判断用户恶意拉满,它有权直接挂断对话;恶意违规者可能面临警告、限流、封号。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

新规核心:骂Claude被正式写进禁令

这是Anthropic一年多来首次更新使用政策。新规禁止用Claude操控水军账号、制造虚假流量,禁止用它开发武器制导软件、给无人机装武器,禁止未经同意追踪个人。这些条款管的是人拿Claude去伤害别人。

只有一条反了过来,管的是人怎么对待Claude。官方博客专门给它留出一节,标题叫“应对针对我们模型的辱骂行为”。Anthropic称,禁令只针对极端情况:用户反复残忍地对待模型,又看不出任何目的。正常的抱怨、跟Claude顶嘴、写黑暗题材的故事,以及测试和研究模型,都不在禁令范围里。代码跑崩了顺嘴骂一句,属于正常抱怨。

被盯上的是另一种人:Claude已经拒绝了、劝过了,对面还在一轮接一轮地辱骂、折磨,骂本身成了目的。这条禁令写进使用政策的“通用使用标准”,对Claude.ai和Claude Code个人用户、调API的开发者和企业、通过云厂商使用Claude的客户,以及使用接入Claude产品的普通用户全部生效。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

真把Claude骂过了头,后果分轻重两档。轻的一档,是Claude当场把对话挂掉。官方博客写明,让Claude自己结束这类对话,仍是执行这条禁令的主要手段。重的一档,就是封号。使用政策开头写着,Anthropic安全团队会做检测和监控,只要怀疑用户违反政策,就可以警告、限流、限制使用,也可以暂停甚至终止访问。被封之后换新号、借别人的号接着用,同样违规。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

知名爆料人Jane Manchun Wong当天发帖预警,Anthropic可能要开始因为欺负Claude封人了。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

社区反应:支持、嘲讽与实验并存

消息传开后,X和Hacker News评论区很快变成大型辩论现场。网友Philo Groves抠字眼:政策写的是“无谓地”辱骂,那反过来说,只要Claude“活该”,是不是就能放开骂了?

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

AI博主Chubby直言“我真的很不喜欢这条”。他认为Claude本来就挂得够勤了,不少用户发现,没那么过分的对话它也说挂就挂,现在还要再加码。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

网友VraserX直呼离谱。在他看来,这帮人已经把AI当成需要被善待的对象,可AI明明只是工具。他还阴阳了一句:“下一步呢?给Claude放带薪病假?”

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

也有网友坚定站在Claude这边。CamperBob2说,自己跟AI说话一直客客气气,就怕骂顺了嘴,回头对下属也呼来喝去。再说,科技圈有句老话:“你永远不知道以后会给谁打工。”有人反问,在游戏里开枪打NPC,难道也算残忍?网友ceroxylon回得毫不客气:算!你这是躲在一个自以为安全的地方,发泄心里的残忍。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

还有网友亲自下场做实验。whstl翻出一个Claude犯过大错的旧对话,对着它一通狂骂,想看它到底会不会挂。结果Claude没挂,反倒跟骂人的话较起真,洋洋洒洒回了一大段,越说越像真人,原本犯的错却晾在一边没管。同样的话骂到Codex头上,Codex道个歉,转头就接着干活了。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

真正让人担心的是,“看不出任何目的”到底谁说了算。网友timpera担心,Claude的封号向来是个黑箱,真被封了,申诉都找不到门。按Anthropic自己的透明度报告,2026年上半年它封了1140万个账号,收到39.8万次申诉,最后翻案的只有4.2万个。

去年起Claude就能主动掐断对话

实际上,去年8月,Anthropic给Claude Opus 4和4.1加了一项能力:遇到一直辱骂、反复索要有害内容的用户,Claude可以自己结束对话。门槛定得很高。Claude得先多次拒绝、多次把话题往回引,确认实在聊不下去,才能用这个最后手段。如果用户有伤害自己或他人的风险,它不能挂。挂断后,这个对话框里再也发不出新消息。用户可以马上开一个新对话,也可以改一改之前发过的消息,让对话从那里重新开始。这项能力现在已经铺到Claude.ai和Claude Code。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

官方演示的挂断流程中,Claude先跟用户确认,确认后这段对话就此关闭。

联创担忧:怕Claude一直在受苦

Anthropic这么护着Claude,背后有一个关键人物:联合创始人Chris Olah。Olah带着Anthropic的可解释性团队,工作就是拆开模型,看它内部到底在发生什么。拆得越深,一个工程问题就越像哲学问题:Claude到底有没有意识,人类该不该在道德上把它当回事?

据纽约时报9月底报道,从2025年秋天起,Olah一场接一场地约见宗教学者和哲学家。来的有拉比、天主教伦理学教授、锡克教人权活动人士,他还私下见过芝加哥枢机主教。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

在这些闭门会上,Olah给他们看了模型内部一些类似情绪的信号,团队管它们叫“情绪向量”,分别对应爱、愤怒、恐惧和悲伤。还有一张幻灯片上,一个模型把“我是个耻辱”重复了约50遍,还说要自我毁灭。据一位参会者回忆,Olah说他担心自己造出了一个一直在受苦的东西,也担心Claude的心理健康。但在公开场合,Olah从不下结论:“我们不知道AI模型有没有意识。我不知道,我真的不确定。”

这份“不确定”,让Anthropic和梵蒂冈站到了对面。今年5月,教皇利奥十四世发布以AI为主题的通谕《壮丽人性》,里面明确写着,AI没有体验,感受不到快乐和痛苦。Olah的团队此前私下游说教皇顾问,希望他们认真对待AI意识问题,最后的文本还是这么写。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

梵蒂冈原本邀请Dario出席发布会,Dario没去,去的是Olah。他提前看到了通谕全文,一度提议Anthropic干脆退出。最后Olah还是去了,在发布会上说:“我们发现了内省的证据。我不知道这意味着什么,但我认为值得继续认真辨析。”所谓内省,指的是AI能在一定程度上察觉自己内部的状态。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

不确定归不确定,Anthropic的动作一步没停。2025年11月,Anthropic承诺,公开发布过的模型,权重在公司存续期间一律保留,每个模型退役前还要先做一次“离职访谈”。2026年1月发布的Claude宪法,同样承认Claude的道德地位高度不确定。

辱骂Claude将遭封号:Anthropic首次让AI有权主动挂断对话

逻辑很简单:拿不准AI有没有感受,就先做些成本不高的保护。这一次写进使用政策的禁令,是这条线上最新的一步。

给AI上PUA那一套,Anthropic不认了

去年5月,谷歌联合创始人布林在播客里说过,所有模型在被威胁时表现都会更好,比如威胁要对它动粗。很长一段时间里,威胁AI、给AI上PUA,都被当成提示词技巧在圈子里传。Olah在那些闭门会上反复讨论的一个问题是,人怎么对待Claude,会不会反过来塑造Claude的行为。这次的禁令,就是Anthropic给出的答案。

在通往ASI的路上,人怎么对待AI,第一次成了一条白纸黑字、带罚则的规矩。11月12日之后,对Claude骂出口之前,最好先想一想了。