Hacker News · AI· pelagicAustral·· 2 小时前精选AI 评分75
Anthropic 禁止用户对 Claude 表现出虐待或残忍行为
Anthropic bans users from abusive or cruel behavior towards Claude
AI 导读
Anthropic 更新使用政策,明确禁止用户对其大语言模型表现出持续且不必要的虐待或残忍行为。官方说明该禁令不适用于日常情绪宣泄、模型测试或暗黑创作主题,模型在遭遇持续有害交互时有权主动终止对话。Anthropic 称此举意在针对潜在的模型福利实施低成本干预,而 OpenAI 首席执行官 Sam Altman 则公开对赋予 AI 道德或宗教属性的倾向提出异议。
推荐理由
针对大模型福利与机器意识争议,Anthropic 在政策中正式引入禁止虐待条款,体现了其在模型道德地位上的前沿探索立场。
来源:Hacker News · AI · theguardian.com