A5站长网10月9日消息,Anthropic发布了2026版Claude使用政策更新。这是一年多来这家公司第一次动这份文件,其中最受关注的一条是新增了对模型的保护:政策明确禁止用户对Claude开展持续且无合理目的的虐待或残忍行为。整套更新将在11月12日正式生效。
官方特意划了边界。这条规定只针对极端情形,也就是用户反复地、看不出什么目的地对模型施加恶意;日常表达不满、提出反对意见、创作暗黑题材,以及模型安全测试和科研活动,都不在禁止范围内。官方在说明里写得很直白:这条更新不是要给普通的情绪发泄立规矩,能落到的场景其实很窄。
怎么执行是另一个被反复问到的点。按政策的表述,Anthropic可以对违规用户提出警告,也可以限流、限制、暂停甚至终止其访问权限;不过官方强调,让对话直接结束仍是主要的执行方式。这个能力其实早就存在:从2025年8月起,Claude在网页版和Claude Code上就已经能够主动结束与持续辱骂者的会话,窗口关掉之后那段对话不能再继续,其他会话不受影响。
更新不只这一处。政策还新增了针对欺骗性宣传的条款,禁止用Claude批量运营虚假账号、写虚假评论、搭虚假新闻站点;官方说这类规则的来源是真实案例,此前已经出现过机构用模型批量运营账号的情况。还有一条要求是,当模型接上能够自主做出物理动作的硬件时,现场必须有有资质的人可以观察设备,并在需要时把它停下来。
新规在技术圈里引出了两种声音。支持的一方认为,模型的行为边界本来就该跟着能力一起往前走;也有不少观点提出,Claude只是一段程序,并不具备主观感受,专门为虐待AI立一条规矩没有必要。这类讨论背后是Anthropic自己一直在推的研究方向,它把模型福利当成一个需要认真对待的议题,此前也公开表示过,并不确定模型是否具有某种意义上的感知,但认为这个问题值得谨慎对待。
A5创业网 版权所有