跳到正文
原文
Hacker News · AI· gpjt·· 1 天前AI 评分33

为什么 OpenAI 的 GPT-2 权重表现优于自训模型?第五部分:数据质量

Why do OpenAI's GPT-2 weights beat mine? Part five: data quality

AI 导读

作者探究了自训 163M 模型在指令微调与测试损失上为何落后于仅 124M 的官方 OpenAI GPT-2 small 权重。在 Alpaca 微调和 GPT 5.5 评测中,GPT-2 small 获得 26.00 分并领先多数自训模型。本篇重点对比 OpenAI 的 WebText 与 FineWeb 数据集,探究训练数据质量对性能差距的影响。

来源:Hacker News · AI · gilesthomas.com