Prime Intellect·· 5 小時前AI 評分74
Prime Intellect 啟動 INTELLECT-2 全球分散式 32B 參數模型強化學習訓練
AnnouncementsAPR 15TH, 2025INTELLECT-2: The First Globally Distributed Reinforcement Learning Training of a 32B Parameter Model
AI 導讀
Prime Intellect 啟動 INTELLECT-2,展開 32B 參數模型的全球分散式強化學習訓練,並開放任何人無需許可地貢獻異構算力。訓練以 QwQ-32B 為基礎,採用 DeepSeek-R1 的 GRPO 方法,聚焦可驗證的數學與編碼任務,並以系統提示詞設定思考 token 預算。
來源:Prime Intellect · primeintellect.ai