Hacker News · AI· itvision·· 2 小时前精选AI 评分70
Anthropic 更新使用政策:禁止持续辱骂模型并收紧武器与监控限制
Anthropic asks users to stop being mean to Claude
AI 导读
Anthropic 更新了使用政策,自 11 月 12 日起禁止用户对 Claude 模型进行持续且不必要的辱骂或残忍行为,但常规测试、研究和合理情绪反馈不受影响。此次更新还明确禁止将 Claude 用于武器制导与控制软件、无授权监控追踪及虚假舆论操控,并要求接入实体硬件时必须保留人工监控和安全断控机制。此外,Anthropic 还推出了面向开源项目与关键基础设施的安全漏洞扫描计划。
推荐理由
原文明确了禁止无端辱骂模型与常规测试的界限,同时在武器软件研发、监控和物理控制上细化了安全合规要求。
来源:Hacker News · AI · theregister.com