跳到正文
原文
Hugging Face Blog·· 2026-06-25精选AI 评分60

NVIDIA NeMo AutoModel 发布,MoE 微调吞吐提升 3.4-3.7 倍

Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel

AI 导读

NVIDIA 发布开源库 NeMo AutoModel,基于 HuggingFace Transformers v5 构建,在微调 MoE 模型时相比原生 v5 训练吞吐提升 3.4-3.7 倍、GPU 显存降低 29-32%,且只需改动一行 import。

推荐理由

原文给出 NeMo AutoModel 在 MoE 微调上的吞吐与显存对比数据,读者可据此判断升级成本与收益。

来源:Hugging Face Blog · huggingface.co