跳到正文

#模型發佈

今日 20 條
今天10月7日週三
  1. Hacker News 熱門(buzzing.cc 中文翻譯)59

    Strands Decider 2B 小型開源決策模型推出

    Strands 團隊開源 Strands Decider 2B,這款 2B 參數決策模型面向快速實驗、本地開發及 Agent 工作流。它在 JevBench 公開集的準確度及校準表現,在 2B 級 33 款模型中排名第 3;排除略高於 2B 的模型後,在 30 款中排名第 1,本地決策中位延遲約 115ms。

  2. MarkTechPost78

    Mistral AI 發佈 Mistral Large 4(Le Chonk)公開預覽版,總參數達 1.05T

    Mistral AI 發佈 Mistral Large 4(ML4,代號 Le Chonk)公開預覽版,這款多模態 MoE 模型總參數為 1.05T、每個 token 啟用 49B,並支援 1M token 上下文窗口。

    推薦理由:文章把參數規模、每 token 啟用量與 API 價格並列,並交代網絡安全評測和權重開放時間,便於判斷預覽版的可用性與限制。

  3. Google Developers Blog62

    EmbeddingGemma 2 開發者指南

    EmbeddingGemma 2 開發者指南介紹這款基於 Gemma 4 的開放模型,可將文字、程式碼、圖像、影片和音訊映射至同一個 768 維向量空間。模型可按需載入由文字與程式碼的 270M 參數配置,擴展至完整多模態的 740M 參數配置,各配置共用同一向量空間。

  4. The Decoder59

    Reflection 的 Beam 成為中國以外開發的最強開放權重模型

    Reflection 宣佈 Beam,這是公司首個可免費使用的開放權重模型,面向編碼、邏輯推理及智能體任務,目標是在較低算力下提供強勁表現。這款混合專家模型每個 token 啟用 23 billion 個參數,總參數量為 501 billion;Reflection 稱,Beam 在高難度推理任務上達到 GLM 5.2 的表現時,所用算力少 3 至 4 倍。

  5. Mistral AI75

    Mistral AI 推出 Mistral Large 4 公開預覽版,權重預計月底釋出

    Mistral AI 推出 Mistral Large 4 公開預覽版,權重預計月底釋出。模型具原生多模態能力,總參數量為 1 trillion、活躍參數量為 49 billion,並可透過 Mistral Studio API 試用。在 Artificial Analysis Cyber Index 名列全球前五,漏洞重現及修補測試得分 82%,Cybench 則解決 93% 的挑戰。

    推薦理由:文章以 Cyber Index、漏洞重現與修補測試及 Cybench 結果,呈現 Mistral Large 4 在網絡安全基準中的相對表現。

10月6日週二
  1. MarkTechPost62

    Reka 發佈 Rho-1 研究預覽版:19B 全模態推理模型可理解及生成影片並輸出機械人動作

    Reka 發佈 Rho-1 的研究預覽版,這款 19B 全模態推理模型以單一神經網絡理解及生成文字、圖像和影片,並對這些內容進行推理及輸出機械人動作。其兩條專家權重流共用 attention 和 KV cache;蒸餾版把去噪步數由 99 步減至 8 步,約 1 秒可生成 5.3 秒影片。Rho-1 目前僅提供研究預覽,尚無公開權重、API 或定價。

  2. ElevenLabs:Blog65

    ElevenLabs 發佈 Music v2 音樂生成模型

    ElevenLabs 發佈音樂生成模型 Music v2,改善不同曲風的歌聲、樂器與編曲表現,並提升多語言支援。用戶可逐段構建完整歌曲,並選取曲目任一部分重新生成,而不影響其他部分。

  3. Zyphra Research55

    Zyphra 發佈 380M 參數 ZUNA 腦電圖基礎模型,支援訊號去噪與重建

    Zyphra 發佈 380M 參數的 ZUNA,這是一款用於腦電圖(EEG)訊號去噪、重建及上採樣的擴散自編碼器基礎模型。在通道缺失超過 75% 時,ZUNA 在所有評估數據集均優於球面樣條插值;模型亦可按電極座標預測新通道訊號。模型以約 2 million channel-hours EEG 數據訓練,並按 Apache 2.0 授權發佈模型權重及推理、預處理程式碼。

  4. Zyphra Research59

    Zyphra 發佈 ZONOS2 即時文字轉語音模型,支援高保真聲音複製

    Zyphra 發佈採用 Apache 2.0 授權的即時文字轉語音模型 ZONOS2,支援高保真聲音複製。模型採用 MoE 架構,規模由前代的 1.6B 增至 8B,即時生成吞吐量較前代提升 4x,並支援最長一分鐘的多語言及語碼轉換語音生成。ZONOS2 提供 stable 和 expressive 兩種模式,分別側重乾淨輸出,以及聲音複製的自然度與保真度。

  5. Prime Intellect56

    Prime Intellect 發佈 INTELLECT-2,這是首個透過全球分散式強化學習訓練的 32B 參數模型

    Prime Intellect 發佈 INTELLECT-2,稱這是首個透過全球分散式強化學習訓練的 32B 參數推理語言模型。訓練以跨異構運算節點的全非同步 RL 為核心,並配套推出 PRIME-RL、TOPLOC 和 SHARDCAST;模型、程式碼及數據均已開源,技術報告見 primeintellect.ai/intellect-2。