跳到正文
原文
Google Developers · AI 筛选·· 22 小时前精选AI 评分67

Google 推出 autofinetune:在 TPU 上基于 Tunix 实现 LLM 自主后训练

Autonomous LLM post-training with Tunix on TPUs

AI 导读

Google 推出开源项目 autofinetune,利用 Gemini Flash 3.7、Tunix 与 Cloud TPU 驱动 AI 智能体自主闭环完成大语言模型的监督微调(SFT)与 GRPO 强化学习后训练。

推荐理由

展示了如何通过规范配置让智能体在硬件集群上自主调优并验证变更,为模型后训练提供了可复用的自动化实践路径。

来源:Google Developers · AI 筛选 · developers.googleblog.com