Google Developers blog10/2 22:21AI 評分43
MaxText 團隊在 TPU 上覆現 Olmo 3 7B 預訓練
該復現用 JAX/XLA 精確匹配原 PyTorch-on-GPU 參考,MFU 達 57.4%,並發現資料載入器記憶 bug。
找到 2 筆
該復現用 JAX/XLA 精確匹配原 PyTorch-on-GPU 參考,MFU 達 57.4%,並發現資料載入器記憶 bug。
開發者用 Sparse VideoGen 將注意力頭動態路由到高度結構化的空間或時間稀疏掩碼,並最佳化 TPU 的 Splash Attention 核心,1440p 影片生成端到端推理最高提速 1.69 倍。