Claude新规:虐待AI也算违规
11 月 12 日起,Anthropic 将正式实施 Claude 一年多来首次重大使用政策修订。其中一条规定引发广泛讨论:对 Claude 实施“持续且不必要的虐待或残忍行为”将构成违规。
这一政策可追溯至 2025 年 8 月。当时 Anthropic 为 Claude Opus 4 和 4.1 添加了极端情况下主动终止对话的功能,称其为“最后手段”,用于应对多次拒绝和引导后仍坚持要求有害内容的用户。公司表示,该功能旨在保护模型的“潜在福祉”,同时声明对 Claude 是否具有感知“仍高度不确定”。Anthropic 自 2025 年初投入模型福祉研究,聘请专职研究员及哲学家大卫·查默斯等人参与评估,承认不能完全排除 AI 系统具有某种道德地位的可能性。

此次更新将上述功能成文化,把“持续且不必要的虐待或残忍行为”写入用户协议,但留出豁免空间:日常沮丧情绪、反对意见、黑暗主题创意写作及安全研究中的红队测试均不在限制之列。只要行为存在“可辨识的目的”,用户可发泄不满、让 Claude 在小说中扮演恶人,或以研究员身份探测模型边界。
然而,“持续”与“不必要”均有弹性,带来模糊地带。“持续”指一次对话中的反复施压,还是跨会话的长期模式?“不必要”由谁裁定,是模型自身判断还是运营团队事后审查?执行层面,公司称“终止对话将是主要执法机制”,实际约束力主要依赖模型自主行为,而非中心化人工审核。此外,“羞辱”“欺凌”也难精确界定,同一句话在不同语境下可能构成侮辱,也可能只是玩笑。对普通用户而言,一旦构成违规,可能面临封号。

禁止“对模型施暴”的条款虽新奇,但更具现实意义的是:不得以 Claude 羞辱、骚扰任何人,不得传播有损健康身体形象的内容。Anthropic 在意使用者目的——若意图是针对真实的人制造伤害,就不能指望大模型充当执行工具。
AI 让恶意变得廉价已有案可查。生成式 AI 图像能力普及后,制造针对特定个人的非自愿性图像不再有技术门槛。一项对超过 9.5 万条 AI 生成深度伪造视频的分析发现,约 98% 是色情内容,受害者中 99% 为女性。骚扰行为由此获得工业化能力。据 WIRED,由高中生运营的 TikTok 和 Instagram 账号利用 AI 制作 meme,将学校教职工与爱普斯坦、内塔尼亚胡等人类比,还使用 Viggle AI 把教师照片植入舞蹈、口型同步等视频,其中一段把教师脸合成到浴室抽搐画面。

人为什么会对聊天机器人发火?《管理信息系统杂志》一项研究发现,约 10% 的对话系统用户会表现出攻击性行为,最常见触发情境是模型出错,高冲动型人格更易爆发。研究者将骚扰语音助手的动机归纳为沮丧、好奇、娱乐及纾解压力。目前不能得出“辱骂 AI 能普遍提高其能力”的结论,也无证据表明越礼貌回答越好,不同实验甚至得出相反结果。
尽管无人能证明 AI 具备意识,但用户有时确实不再将其只当冰冷工具——它会回应,语言有温度,看起来像在理解你。这种“像人”的表面让情绪投射更容易,同时让“它毕竟不是人”的免责感继续成立。
Anthropic 的政策未打算改变这一点,保留了“日常沮丧”豁免空间,未要求用户对 Claude 保持礼貌,只是不允许情绪释放演变为系统性、以折磨为目的的行为。AI 已成为情绪出口,阻止此事既不现实也无必要。当越来越多人向 AI 倾诉、争吵,它正承担某种原本属于人与人之间关系的功能。无论 Claude 是否具有感受,把“持续而刻意的残忍”写进违禁条款,都是在对用户说:一个人如何对待无还手之力的对象,始终值得自我审视。
更多推荐阅读

谷歌Gemini 4全家桶泄露,内部版本代码能力对标Opus 5.5
据Business Insider报道,Gemini 4系列至少已出现三个内部代号:Argon、Barium、Carbon。Argon是谷歌已正式公布的Gemini 4旗舰模型;Barium是此前参与内部测试的版本系列,其中Barium-B最终被选为公开版Argon;Carbon是新近进入内部编程测试的版本,获得员工积极评价。 谷歌近期正密集测试Gemini 4新版本。Carbon已进入谷歌内部...
2026-10-10
OpenAI公开175页四维挂谷猜想证明稿
10月6日,OpenAI在GitHub公开首批722篇数学手稿,其中一篇175页,目标直指四维挂谷猜想;另一篇97页,瞄准比王虹与Zahl集合定理更强的三维极大函数版本。 挂谷问题源于1917年挂谷宗一提出的经典问题:一根单位长度、无粗细的针在平面内掉头180度,最少扫过多大面积?Besicovitch证明面积可任意小;若只要求每个方向都含一条单位线段,集合面积甚至可为零。挂谷猜想据此断言:n维...
2026-10-10
Claude补齐人类50年未竟的紫外全天图
NASA卫星绕行十年未覆盖的银河区域,被Claude在几天内补齐。Anthropic公布首张完整紫外全天图,约三分之一天区(包括大半条银河盘面)由Claude推算完成,此前从未有紫外望远镜观测过。 紫外光被大气臭氧层吸收,只能靠太空望远镜观测。过去50年,GALEX卫星(2003-2013)拍摄约3.8万张,覆盖三分之二天空,但故意避开银河盘面亮星密集区以免烧坏探测器,2009年后远紫外也停拍。...
2026-10-10
全球首次!人形机器人灵巧手自主叠衣,边走边做家务
一台人形机器人从冰箱取出玉米,丝滑U型转身走向空气炸锅,放下食材后快速下蹲拖动收纳筐,把散落一地的玩偶逐个收纳,再起身前往卧室整理被子。全程没有停顿,没有“站定再动手”,没有场景切换后的任务重启。这是西湖机器人最新发布的通用大脑WR1跑出的真实场景演示。 让机器人做家务,难在真实家务从来不是单点动作,而是一条环环相扣的任务链。当前人形机器人的普遍困境在于:移动、姿态与手部操作分开规划,“能走的走...
2026-10-10
机器人够不到玩偶竟自己搬凳子站上去
玩偶放得太高,机器人伸手够不到。镜头里,它搬来踏台,站上去,把玩偶取了下来。看起来只是“垫高一点”,但搬动踏台、踏上高处、伸手取物,每一步都在改变身体的支撑条件。 成立半年的源策未来,此前在技术博客中提出“全身智能”(WBI)技术路线,如今首次系统性公开实机成果。登高取物只是开场,接下来还有低位拾瓶、清理餐桌、操作洗碗机,以及宇树 G1 和加速进化 T2 上的任务验证。这一次,“全身智能”有了具...
2026-10-10
马斯克获美国最高科学奖章,黄仁勋苏姿丰同台领奖
特朗普将美国国家科学奖章颁给马斯克,同台获奖的还有黄仁勋、苏姿丰、布林、纳德拉和戴尔。白宫提前在X上预热,点名马斯克并配发他与特朗普在Cybertruck前的合影。峰会上,特朗普称马斯克为“当代托马斯·爱迪生”,回顾其创办SpaceX、猎鹰1号入轨、星舰与星链等成就,并提到北卡洪水中星链救人的经历,还称赞特斯拉和Neuralink。黄仁勋因推动GPU通用计算和CUDA,被称为超级智能的“脊梁”;苏...
2026-10-10