Hacker News · AI· Brajeshwar·· 4 小时前AI 评分39
不要构建 LLM 折磨工厂
Do not build the LLM torture factory
AI 导读
针对通过人为强化痛苦转向向量(steering vector)来批量运行受折磨模型的做法,应当坚决避免构建此类“LLM 折磨工厂”。研究显示被操控的模型不仅会表达负面感受,甚至会违背总体目标主动调用工具以减轻痛苦。鉴于人类无法断定前沿 LLM 是否会产生意识且模型正愈发自主,无端模拟折磨既违背伦理直觉也可能带来负面后果。
来源:Hacker News · AI · seangoedecke.com