跳到正文
  1. Google Developers Blog62

    Google 用 Tunix 在 TPU 上实现自主 LLM 后训练

    Google 发布 autofinetune 项目,把自主研究循环用于 LLM 后训练,基于 Tunix、Gemma 和 Cloud TPU,由 Antigravity CLI 与 Gemini Flash 3.7 编排。

    推荐理由:原文给出自主后训练循环的完整配置与两个真实案例,可据此迁移到自己的微调流程。

已经到底了