Hugging Face Blog·· 2026-06-25精选AI 评分60
NVIDIA NeMo AutoModel 发布,MoE 微调吞吐提升 3.4-3.7 倍
Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel
AI 导读
NVIDIA 发布开源库 NeMo AutoModel,基于 HuggingFace Transformers v5 构建,在微调 MoE 模型时相比原生 v5 训练吞吐提升 3.4-3.7 倍、GPU 显存降低 29-32%,且只需改动一行 import。
推荐理由
原文给出 NeMo AutoModel 在 MoE 微调上的吞吐与显存对比数据,读者可据此判断升级成本与收益。
来源:Hugging Face Blog · huggingface.co