跳到正文
热点事件持续更新

研究探索强化微调对大模型社交博弈能力的影响

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

2026年10月,发表于arXiv的一项研究通过社交推理游戏探讨了强化微调(RFT)对大语言模型社交行为的影响。研究表明,仅以最终胜负作为优化目标,无法使模型稳定获得社交推理能力。但RFT能够显著提升模型推断隐藏角色的社交洞察力,以及引导投票等社交影响力。在此基础上,结合社交洞察力与社交影响力的多智能体社交认知RFT进一步提升了游戏表现,并在策略能力与说服力两个维度上获得了更高的人类评估得分。

AI 根据报道生成 · 5 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. arXiv 自然语言处理
    基于强化微调的大语言模型在社交推理游戏中的表现

    研究通过社交推理游戏探讨了强化微调(RFT)对大语言模型社交行为的影响,发现仅优化最终胜负无法让模型稳定获得社交推理能力。但 RFT 能显著提升模型推断隐藏角色的社交洞察力,以及引导投票等社交影响力。结合两者的多智能体社交认知 RFT 进一步提升了游戏表现,并在策略能力与说服力上获得了更高的人类评估得分。

本事件热度走势

当前热度 9·可比范围峰值 10(10月6日 13:00)·近 24 小时可比范围变化 –

02.557.51010月6日13:0010月6日14:0010月6日15:0010月6日16:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。