Hugging Face Blog·· 2025-07-08精選AI 評分65
Hugging Face 發佈 SmolLM3,支援 128k 上下文的多語言 3B 推理模型
SmolLM3: smol, multilingual, long-context reasoner
AI 導讀
Hugging Face 發佈 3B 模型 SmolLM3,使用 11.2T tokens 訓練,支援 think / no_think 雙模式推理及最高 128k 上下文。
推薦理由
SmolLM3 公開分階段訓練、長上下文適配與雙模式推理配方,並交代數據配比和模型合併流程,呈現 3B 模型的工程實作路徑。
來源:Hugging Face Blog · huggingface.co