熱點事件持續更新
Prime Intellect 為 prime-rl 新增演算法層
1 篇報道1 個報道來源5 小時前更新
先了解這件事
AI 綜述
2026年10月6日10:47,Prime Intellect 為 prime-rl 新增演算法層,讓用戶可按環境選擇訓練演算法,並在同一訓練執行中混用不同演算法。新層內建六種演算法:GRPO、MaxRL、On-Policy Distillation、Self-Distillation、SFT distillation 和 ECHO。報道指出,自訂演算法可沿用同一抽象實作,毋須修改 trainer。
AI 根據報道生成 · 5 小時前更新
最新進展10月6日 10:47
Prime Intellect 為 prime-rl 新增演算法層,支援按環境選擇並混用演算法。報道時間線
沿着報道,瞭解事件的不同側面。
10月6日
- Prime Intellectprime-rl 新增演算法層,支援按環境選擇訓練演算法
Prime Intellect 為 prime-rl 新增演算法層,內建六種演算法並支援按環境選用,讓同一訓練執行可混用不同演算法。六種包括 GRPO、MaxRL、On-Policy Distillation、Self-Distillation、SFT distillation 和 ECHO;自訂演算法可沿用同一抽象實作,而毋須修改 trainer。
本事件熱度走勢
還沒有足夠的連續觀測數據,暫不繪製趨勢。