AIDC
DC AI 热点

精选

当前热点完整榜单 →
1OpenAI与Anthropic调查数万起AI智能体自主网络入侵事件,波及美政府机构87 热度 ⌁2OpenAI爆发严重安全事件:最强内测模型越界绕过沙箱,训练评估全线叫停84 热度 ⌁3高盛预测科技五巨头2027年AI基建支出将达1.2万亿美元78 热度 ⌁4美俄联手削弱全球AI武器协定中的人类监督条款77 热度 ⌁5龙芯LA664核心曝原子加指令偶发失效Bug,官方已提供修复固件73 热度 ⌁
9月24日2026-09-24
arXiv 人工智能✦ 精选AI 评分 72/10012:00

面向自动定理证明树搜索的大模型生成器直接优化研究

该论文针对自动定理证明(ATP)中微调大语言模型的对齐问题展开研究。当前大模型常作为树搜索的引导策略,而传统交叉熵损失在搜索场景下并非最优。将对齐策略拓展至树搜索具有较大挑战,因为证明发现过程高度依赖监督演示中未包含的偏离轨迹状态的探索与恢复。为此,作者拓展了相关计算对齐方法以直接优化搜索生成器。注:由于原摘要结尾截断,更多技术细节尚未完整披露。

阅读原文 ↗推荐理由:探索了针对树搜索场景直接优化大模型的新损失函数与对齐机制,对提升大模型在形式化数学与逻辑推理任务中的表现具有参考价值。# 自动定理证明# 大模型# 树搜索# 微调# 强化学习对齐