Anthropic 更新使用政策:对 Claude 持续无端地辱骂虐待,算违规
Anthropic 修改了 Claude 的使用政策,这是一年多来的第一次,新版 11 月 12 日生效。最受关注的一条是,用户不得对 Claude“持续且无必要地实施辱骂或残忍行为”。
这条规定来自 Anthropic 的“模型福利”研究,研究的问题是 AI 模型会不会有某种值得被考虑的感受。去年 8 月,Anthropic 已经让 Claude 可以主动结束和“持续有害或辱骂”用户的对话。新政策说,结束对话仍是“主要的执行手段”。会不会进一步封号,Anthropic 没有回应 The Verge 的询问,不过官方政策页的通用条款写着,违规者可能被警告、限流、暂停或终止使用。
普通用户不用紧张。Anthropic 说这条只针对极端情况,也就是用户反复虐待模型,又看不出任何目的。平时对 AI 发火、跟它争论、写黑暗题材的小说、做模型测试和研究,都不算。
其余改动针对的是高风险滥用。
虚假宣传:原来分散在各处的限制合并成了一条,禁止用 Claude 搞欺骗性的商业或政治宣传,比如隐瞒信息背后的真实发布者,或者用假账号、假帖子刷量造势。
选举:禁止散布关于候选人或投票方式的虚假信息,禁止冒充候选人或选举官员,禁止压低投票率、干扰投票和计票。
武器:Claude 一直禁止用于开发武器,但 Anthropic 说发现有人多次尝试用它写武器相关的指导和控制软件。新政策把禁令扩展到“让武器运转的软件和部件”,也包括给无人机和其他自动驾驶载具装上武器。
监控、医疗和金融:未经本人同意追踪他人被明确禁止,人脸识别、预测性警务都在列。诊断病情、调整用药剂量、推荐买卖具体的投资产品,被划为高风险用途。开发者用 Claude 做这类产品,结果交给用户之前必须经过合格的专业人士审核,还要告诉用户内容由 AI 生成。一般的健康科普和投资常识不受这条限制。
对做 AI 问诊、AI 理财顾问的开发者来说,11 月 12 日之后,流程里要加上人工审核这一步。
https://t.co/saNj5GIwRU
点击图片查看原图