把Claude接进客服、办公系统或内容平台后,企业不只要管它“会不会答错”,还要知道哪些用途根本不能碰。Anthropic此次更新usage policy——模型供应商规定允许、限制或禁止哪些用途的规则,新增了对选举干预、武器软件和监控的明确禁令。对开发者和企业客户来说,这些条款也会进一步落到权限、审核与留痕流程中。
据TechCrunch报道,最受关注的新规是禁止用户长期、反复辱骂模型。Claude自今年8月起已被训练为主动结束“持续有害或辱虐”的对话;新版政策则进一步约束用户。不过Anthropic称,这条红线只针对毫无明显目的、反复残酷对待模型的极端情况,不涵盖普通的沮丧、反驳、黑暗题材创作,以及模型测试与研究。
政策还禁止利用Claude运营虚假账号或捏造新闻机构等欺骗活动,并以“不得破坏民主进程”单列规则,限制欺骗选民或扰乱选举。换句话说,Anthropic正在把过去较笼统的安全原则写成更具体的合规边界。