热点事件持续更新
研究探索强化微调对大模型社交博弈能力的影响
1 篇报道1 个报道来源5 小时前更新
先了解这件事
AI 综述
2026年10月,发表于arXiv的一项研究通过社交推理游戏探讨了强化微调(RFT)对大语言模型社交行为的影响。研究表明,仅以最终胜负作为优化目标,无法使模型稳定获得社交推理能力。但RFT能够显著提升模型推断隐藏角色的社交洞察力,以及引导投票等社交影响力。在此基础上,结合社交洞察力与社交影响力的多智能体社交认知RFT进一步提升了游戏表现,并在策略能力与说服力两个维度上获得了更高的人类评估得分。
AI 根据报道生成 · 5 小时前更新
最新进展10月6日 12:00
研究显示结合社交洞察与影响力的多智能体RFT可显著提升大模型的策略能力与说服力。报道时间线
沿着报道,了解事件的不同侧面。
10月6日
- arXiv 自然语言处理基于强化微调的大语言模型在社交推理游戏中的表现
研究通过社交推理游戏探讨了强化微调(RFT)对大语言模型社交行为的影响,发现仅优化最终胜负无法让模型稳定获得社交推理能力。但 RFT 能显著提升模型推断隐藏角色的社交洞察力,以及引导投票等社交影响力。结合两者的多智能体社交认知 RFT 进一步提升了游戏表现,并在策略能力与说服力上获得了更高的人类评估得分。
本事件热度走势
当前热度 9·可比范围峰值 10(10月6日 13:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。