跳到正文
原文
Hugging Face Blog·· 2025-07-08精选AI 评分66

Hugging Face 发布开源 3B 模型 SmolLM3,支持 128k 长上下文与双模式推理

SmolLM3: smol, multilingual, long-context reasoner

AI 导读

Hugging Face 发布完全开源的 SmolLM3-3B,用 11.2T tokens 分三阶段预训练,性能超越 Llama-3.2-3B 和 Qwen2.5-3B,并与 Qwen3-4B、Gemma3-4B 等更大模型竞争力相当。

推荐理由

官方同步放出模型、三阶段预训练配比和双模式推理完整训练配方,适合想复现或改进同级小模型的研究者对照学习。

来源:Hugging Face Blog · huggingface.co