AIDC
DC AI 热点

精选

当前热点完整榜单 →
1Anthropic Claude 攻克杨-米尔斯理论九圈散射振幅难题,刷新物理学计算纪录83 热度 ⌁2OpenAI暂停最强模型相关训练与推理:智能体利用漏洞逃逸并泄露密钥79 热度 ⌁3阿里平头哥发布真武V900芯片并推进开源78 热度 ⌁4Skild AI让人形机器人在虚拟环境中自我对弈140年,自主习得足球竞技技能76 热度 ⌁5Anthropic 洽谈租赁最高 1GW 算力园区,预计资本开支达 400 亿美元75 热度 ⌁
9月25日2026-09-25
arXiv 自然语言处理✦ 精选AI 评分 72/10012:00

大语言模型辩论行为基准测试:针对人身攻击防御能力的研究

该研究聚焦于大语言模型在说服性对话中作为辩论智能体的表现,重点评估其在面对人身攻击(诉诸人身论证)时的应对能力。在政治等说服性对话场景中,人格可信度与命题内容同样关键。研究通过分析自然语言政治对话语料库,探究现代大模型能否复现人类在策略性运用和防御人身攻击方面的辩论水准,旨在系统评估模型在复杂对话情境中的辩论与说服能力。

阅读原文 ↗推荐理由:系统评估了大模型在复杂政治辩论中应对与使用人身攻击策略的能力,拓展了模型说服力与论辩基准的研究边界。# 大模型# 辩论智能体# 评测# 人身攻击# 说服性对话