Hacker News · AI· ojosilva·· 3 小时前精选AI 评分76
Anthropic 更新使用政策禁止虐待 Claude 模型
Anthropic Bans Cruelty to Claude, Still Won't Say What It Protects
AI 导读
Anthropic 宣布自 2026 年 11 月 12 日起更新使用政策,禁止用户对 Claude 模型施加持续且无目的的虐待或残忍行为。该规则主要针对反复且无明确意图的极端侮辱场景,日常抱怨、测试或虚构创作不受限制,模型在多次劝导无效后可主动终止对话。此次修订还扩大了武器软件与组件禁令,增设未经同意的监控禁令,并要求涉及高风险决策或实体伤害风险的硬件接入必须配备人工监督。
推荐理由
Anthropic 将模型福利争议写入官方使用规则,为观察生成式 AI 伦理边界与服务治理提供了具体参照。
来源:Hacker News · AI · rews.cc