Hugging Face Blog·· 2026-06-25AI 评分57
NVIDIA NeMo AutoModel 基于 Transformers v5 加速 MoE 模型微调
Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel
AI 导读
NVIDIA NeMo AutoModel 构建在 HuggingFace Transformers v5 之上,只需更改一行 import 即可微调 MoE 模型,相比最优的 v5 配置训练吞吐提升 3.4-3.7x、GPU 显存降低 29-32%。
来源:Hugging Face Blog · huggingface.co