不换代码提速近4倍:NVIDIA如何给HuggingFace装上MoE训练加速器
NVIDIA NeMo AutoModel无缝接入HuggingFace生态,仅改一行导入代码即可让MoE模型微调吞吐量提升3.4-3.7倍,显存占用下降约30%。
Hugging Face Blog · 2026年6月25日
NVIDIA NeMo AutoModel无缝接入HuggingFace生态,仅改一行导入代码即可让MoE模型微调吞吐量提升3.4-3.7倍,显存占用下降约30%。
智谱开源 GLM-5.2 登顶榜单但极度耗 token,揭示开源模型“力大砖飞”与高性价比并存的新阶段。