arXiv 人工智能· Qirui Zheng, Zhengteng Lin, Yunyi Xiao, Junhao Li, Keyuan Cheng, Xingbo Wang, Yongyi Wang, Lingfeng Li, Yunlong Lu, Wenxin Li·· 4 小时前AI 评分33
GameCommBench:面向 AI 游戏解说的统一评测基准与类型感知评估框架
GameCommBench: A Unified Benchmark and Type-Aware Evaluation for AI-Generated Game Commentary
AI 导读
研究团队推出 GameCommBench 统一基准,涵盖棋类、体育与电子竞技,将解说与异构游戏语境对齐并按解说类型进行标注。配套提出的 TACE 框架可对不同类型解说展开结构化评估,并已验证具备可靠性与人类一致性。对代表性 AI 解说员的评测表明,实时观察和策略分析是当前大模型的主要能力瓶颈。
来源:arXiv 人工智能 · arxiv.org