Hacker News · AI· mikelgan·· 4 小时前精选AI 评分75
Anthropic 更新使用政策,禁止对 Claude 实施虐待或残忍行为
Anthropic bans 'abusive or cruel behavior' towards Claude
AI 导读
Anthropic 一年多来首次更新使用政策,正式禁止用户对 Claude 实施持续且无明显目的的辱骂或残忍行为,主要执行手段仍为终止对话。新规还整合并扩大了高风险滥用禁令,严禁将 Claude 用于武器制导与控制软件开发、未经许可的人身监控追踪以及虚假政治宣传或选举干扰。此外,政策新增要求模型接入具备自主行动且可能致伤的物理硬件时,必须配备合格操作员在场监督并可随时叫停。
推荐理由
新规明确了禁止针对模型的虐待行为与物理控制红线,有助于读者了解前沿机构在模型福利与合规管控上的最新边界。
来源:Hacker News · AI · theverge.com