跳到正文
Google Developers Blog·· 28 天前精选AI 评分62

Google 用 Tunix 在 TPU 上实现自主 LLM 后训练

Autonomous LLM post-training with Tunix on TPUs

AI 导读

Google 发布 autofinetune 项目,把自主研究循环用于 LLM 后训练,基于 Tunix、Gemma 和 Cloud TPU,由 Antigravity CLI 与 Gemini Flash 3.7 编排。

推荐理由

原文给出自主后训练循环的完整配置与两个真实案例,可据此迁移到自己的微调流程。

来源:Google Developers Blog · developers.googleblog.com