跳到正文
原文
Hugging Face Blog·· 2025-07-08精選AI 評分65

Hugging Face 發佈 SmolLM3,支援 128k 上下文的多語言 3B 推理模型

SmolLM3: smol, multilingual, long-context reasoner

AI 導讀

Hugging Face 發佈 3B 模型 SmolLM3,使用 11.2T tokens 訓練,支援 think / no_think 雙模式推理及最高 128k 上下文。

推薦理由

SmolLM3 公開分階段訓練、長上下文適配與雙模式推理配方,並交代數據配比和模型合併流程,呈現 3B 模型的工程實作路徑。

來源:Hugging Face Blog · huggingface.co