跳到正文
熱點事件持續更新

Prime Intellect 為 prime-rl 新增演算法層

1 篇報道1 個報道來源5 小時前更新

先了解這件事

AI 綜述

2026年10月6日10:47,Prime Intellect 為 prime-rl 新增演算法層,讓用戶可按環境選擇訓練演算法,並在同一訓練執行中混用不同演算法。新層內建六種演算法:GRPO、MaxRL、On-Policy Distillation、Self-Distillation、SFT distillation 和 ECHO。報道指出,自訂演算法可沿用同一抽象實作,毋須修改 trainer。

AI 根據報道生成 · 5 小時前更新

報道時間線

沿着報道,瞭解事件的不同側面。

10月6日
  1. Prime Intellect
    prime-rl 新增演算法層,支援按環境選擇訓練演算法

    Prime Intellect 為 prime-rl 新增演算法層,內建六種演算法並支援按環境選用,讓同一訓練執行可混用不同演算法。六種包括 GRPO、MaxRL、On-Policy Distillation、Self-Distillation、SFT distillation 和 ECHO;自訂演算法可沿用同一抽象實作,而毋須修改 trainer。

本事件熱度走勢

還沒有足夠的連續觀測數據,暫不繪製趨勢。