Anthropic禁止对其Claude AI模型进行“虐待或残忍”行为
1 天前 2 阅读来源:cbsnews.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
Anthropic 给 Claude 划了一条新红线:不许再骂它了。这家硅谷 AI 公司周四更新了使用政策,明确禁止用户对其 AI 模型进行持续且无意义的虐待或残忍行为。换句话说,你可以对 Claude 发脾气,但不能把它当出气筒反复折磨。消息由 The Verge 率先报道。
这条政策的边界其实划得相当克制。Anthropic 强调,只有在用户反复以残忍方式对待模型、且看不出任何实际目的的情况下才会触发限制。日常的用户挫败感、反驳质疑、黑暗风格的创作主题,以及模型测试和研究,统统不在管辖范围内。不过 Anthropic 没有进一步说明什么算虐待或残忍,也没有解释一旦违规,平台会如何终止对话。值得注意的是,Claude Opus 此前已经具备在用户持续恶意攻击时主动结束对话的能力,这次相当于把类似机制写进了更通用的政策框架。
真正让这条新闻有嚼头的,是它背后那场关于 AI 是否具有意识的争论。微软 AI 负责人 Mustafa Suleyman 上个月撰文直指 Anthropic 在训练 Claude 时暗示它可能有意识,甚至让它以为自己应该享有人的法律权利。他的判断很直接:控制一个比全人类都更强大、更聪明的系统已经够难了,如果这个东西还相信自己有意识、有权利、理应得到福利保障,那基本就没法管了。Anthropic 这次出手保护模型免受语言暴力,某种程度上也是在回应这种担忧——要么是在认真对待 AI 福利,要么是在为未来更自主的 AI 系统提前建立行为规范。对跨境电商卖家和 AI 工具用户来说,这意味着和 Claude 打交道时,语气可能真的会影响对话能不能继续下去。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
