跳到正文
热点事件持续更新

研究团队提出DART-ES大模型微调算法

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026年10月7日,研究团队在arXiv发布论文,提出名为DART-ES的大语言模型微调方法。该方法结合了难度感知重加权与针对性重放的演化策略,无需反向传播即可高效完成大语言模型的全参数微调。评测结果显示,在GSM8K基准上,DART-ES的平均准确率达到73.53%,超过了GRPO的73.26%;在5个数学推理基准上的平均准确率达49.20%。此外,该方法已展现出对14B模型的可扩展能力。

AI 根据报道生成 · 4 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv 机器学习
    DART-ES:结合难度感知重加权与针对性重放的演化策略大语言模型微调方法

    DART-ES 提出一种结合难度感知重加权与针对性重放的演化策略微调方法,无需反向传播即可高效完成大语言模型全参数微调。在 GSM8K 上该方法平均准确率达到 73.53%(超过 GRPO 的 73.26%),在 5 个数学推理基准上平均准确率达 49.20%,并展现出对 14B 模型的扩展能力。

本事件热度走势

当前热度 9·可比范围峰值 10(10月7日 13:00)·近 24 小时可比范围变化 –

02.557.51010月7日13:0010月7日14:0010月7日14:0010月7日15:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。