跳到正文

全部動態

今日 420 條
今天10月6日週二
  1. HuggingFace Daily Papers(社區熱門論文)48

    RealtimeWAM:一步式非同步世界動作模型

    RealtimeWAM 透過一步動作生成與非同步推理,提升世界動作模型(WAM)的推理效率。其提出 Teacher-Anchored Consistency Distillation(TACD)及 Cross-Expert Wavefront Pipelining(CEWP),分別減少動作生成的多步迭代與影片、動作專家之間的等待。

  2. HuggingFace Daily Papers(社區熱門論文)62

    研究提出以校準式內容認證判斷影像真實性可否被合理否認

    研究提出並評估一種以生成器忠實重建能力校準的內容認證方法,用來判斷影像真實性是否可被合理否認。研究測試 20 款深偽檢測器對 10 個近四年推出的生成器,準確率由接近完美的 99.5% 降至 76%;對抗性擾動則令所有基線檢測器的準確率跌至 2% 以下。新方法可校準至生成內容遭錯誤認證的比例不超過 1%,並在所評估的有界擾動攻擊下維持此上限,但不涵蓋任意對抗性轉換。

  3. Cerebras:Blog76

    OpenAI 與 Cerebras 簽訂多年協議,部署總容量達 750 megawatts 的晶圓級系統

    OpenAI 與 Cerebras 簽訂多年協議,將分階段部署 750 megawatts 的 Cerebras 晶圓級系統,為 OpenAI 客戶提供服務。部署將於 2026 年開始;Cerebras 稱這將成為全球最大高速 AI 推理部署。Cerebras 表示,其系統上的大語言模型在編碼智能體或語音聊天場景中,回應速度較基於 GPU 的系統快達 15×。

    推薦理由:文章列出 750 megawatts 的部署規模,並引述 Cerebras 稱其推理回應較 GPU 系統快達 15×,呈現合作的規模與方案定位。

  4. Cerebras:Blog43

    Cerebras Inference 推出 Multi-LoRA 多適配器支援

    Cerebras 在 Cerebras Inference 推出 Multi-LoRA,支援團隊以單一共享基礎模型搭配多個 LoRA 適配器,並按每次請求切換適配器。該功能支援以 HF PEFT 格式部署 LoRA,現正向 Cerebras Inference 專用端點用戶提供私人預覽,毋須額外付費。團隊可按領域、任務、客戶及工作流程專門調整模型行為。

  5. Cerebras:Blog29

    更快推理如何為網絡安全公司帶來優勢

    更快的模型推理讓網絡安全公司能在既有工作流程內處理更多上下文、推理及驗證,並維持流暢的用戶體驗。實務上可採分層架構,由規則、傳統模型及小型語言模型先行篩選、分類和分流,再把可疑事件、高風險發現等交由較強的推理模型深入分析,兼顧日常流程速度與重要個案的分析深度。

  6. NAVER / CLOVA 研究33

    NAVER 的 AI 安全應對方針

    NAVER 以人為本推進 AI 安全,並從技術限制、濫用風險及失控風險三方面著手應對。其 Future AI Center 專責 AI 安全研究,紅隊會在包括仇恨言論、暴力及偏頗資訊等 14 個範疇定期測試 AI 模型。NAVER 亦致力確保選舉相關 AI 生成內容附有聲明,並分享研究原始碼及數據集、提供安全使用培訓。

  7. NAVER / CLOVA 研究50

    NAVER 的 AI 安全框架

    NAVER 的 AI 安全框架以人為本,識別、評估及管理 AI 系統由開發至部署各階段的風險。框架把風險分為失控與濫用兩類,分別採用風險評估尺度及矩陣。NAVER 的目標是每 3 個月評估前沿 AI;效能提升 6x 時則提前評估。

  8. Thinking Machines Lab:News60

    Thinking Machines Lab 推出 Tinker 微調 API,並開源 Tinker Cookbook

    Thinking Machines Lab 推出 Tinker,一個用於微調語言模型的彈性 API,並以託管服務處理分散式訓練。Tinker 支援多種大、小型開放權重模型,包括 Qwen-235B-A22B;開源 Tinker Cookbook 提供可在 Tinker API 上執行的後訓練方法實作。Tinker 目前處於研究者和開發者私人測試階段,初期免費,並將於未來數週引入按用量收費。

  9. Thinking Machines Lab:News39

    Tinker 徵集社羣項目

    Tinker 邀請開發者和研究人員提交社羣項目,並計劃定期在網誌刊出精選成果。徵集涵蓋機器學習研究、微調模型應用、產品原型、數據集及基礎設施;投稿應附研究説明,最好開源程式碼,並展示嚴謹評估和透明結果。

  10. IT之家67

    彭博:希捷與東芝競購 TDK 硬碟磁頭業務,談判仍處初步階段

    彭博報道指,希捷與東芝正競購 TDK 硬碟磁頭業務,相關談判仍處初步階段,交易價值最高可達數十億美元。東芝今年春季先與 TDK 洽談,希捷則於夏季提出更高報價;三家公司高層上週三在東京討論零件持續供應及成立合資公司的可能性。TDK 是全球唯一獨立生產硬碟磁記錄磁頭的製造商,這項交易不論由哪一方完成,都須接受反壟斷審查。

  11. IT之家67

    消息指月之暗面完成上市前最後一輪融資,估值約500億美元,計劃明年第一季赴港IPO

    據報,月之暗面已完成上市前最後一輪私募融資,估值約500億美元,並計劃明年第一季在香港IPO。知情人士稱,IPO募資上限為50億美元,公司ARR目前為10億美元,預計12月升至20億美元。《The Information》稱,監管機構已就深度求索(DeepSeek)與月之暗面啟動數據安全調查;相關調查對估值及IPO進度的影響尚不清楚,IPO時間表仍有變數。

  12. Eugene Yan:Writing71

    產品評測的三個簡單步驟

    Eugene Yan 提出產品評測的三步流程:標註小型數據集、校準 LLM 評估器,並在每次配置變更後執行實驗與評測。他建議採用二元標籤,在 200 個以上樣本中準備 50–100 個失敗案例,並以 75% 樣本校準、25% 留作測試;不同評測維度應使用獨立評估器。

  13. Eugene Yan:Writing73

    如何與 AI 協作,讓工作成果持續累積

    Eugene Yan 分享一套與 AI 協作、讓工作成果持續累積的方法,涵蓋整理上下文、將個人偏好寫入設定、降低驗證成本、委派較大任務及持續修正流程。他建議以專案索引和 CLAUDE.md 保存背景與偏好,把每週至少做一次的工作整理成按需載入的技能,並根據工作階段紀錄修訂設定。

  14. Eugene Yan:Writing67

    構建網絡安全評測的設計模式

    Eugene Yan 梳理多個網絡安全基準,歸納智能體評測的共同設計模式,並比較它們衡量漏洞發現、重現與利用能力的方法。文章將常見設計概括為沙盒目標環境、影響任務難度的資訊、工具和評分器,並介紹 Cybench、CVE-Bench、CyberGym 等基準如何提供部分分數或按攻擊階段分級。

  15. Cohere 產品與研究博客38

    Cohere 與滑鐵盧大學展開合作,培育加拿大 AI 人才

    Cohere 與滑鐵盧大學合作開發 AI 轉型及變革管理證書課程,協助學生掌握推動職場 AI 轉型所需的實務技能。課程由該校 Future of Work Institute 主導,屬非學分課程,預計於 2026 年秋季推出,結合課堂學習、職場體驗及協作解難。學生將透過應用項目及有系統的實習機會,與機構合作發掘、排序及落實 AI 用例。

  16. Cohere 產品與研究博客52

    Cohere 研究提出「文化漏斗」,指出訓練流程中的文化多樣性逐步收窄

    Cohere 分析超過 5.6 million 個涵蓋不同訓練階段的樣本,發現文化多樣性由預訓練進入後訓練時持續收窄。增加語言種類可擴大地理多樣性,但整體文化內容比例會趨於停滯。在 TinyAya base model 微調時加入文化標記後,NormAd、BBQ、GMMLU 分別提升 +8%、+6%、+2.3%,且一般多語能力未受損。

  17. ElevenLabs:Blog16

    ElevenLabs 網誌第 5 頁:AI 語音產品與應用文章

    ElevenLabs 網誌第 5 頁列出 2026 年 8 月 3 至 13 日的文章,聚焦 ElevenAgents、語音複製及 AI 配音等產品與應用。其中包括 Dubbing v2 已可經 ElevenAPI 使用,以及 ElevenReader Voice Chat 配合 ElevenAgents 將平均聆聽時間提升 24% 的案例。

  18. Cohere 產品與研究博客32

    企業生成式 AI:應用案例、效益與採用方式

    企業可用生成式 AI 搜尋及整合知識、創作內容、提供對話支援、協助軟件開發與數據分析,並自動化多步工作流程。用得其所可提升生產力和工作質素、擴大個人化體驗,並加快創新。採用時須先確認生成式 AI 能否切合具體業務需要並值得投資,避免在缺乏明確商業理據下增加成本與複雜程度。

  19. ElevenLabs:Blog16

    ElevenLabs Blog 第 2 頁文章列表

    ElevenLabs Blog 第 2 頁收錄 9 月 23 日至 10 月 5 日刊出的文章,涵蓋 Eleven v4、語音智能體、轉錄及 API 等主題。內容亦包括 Eleven v4 Turbo 現已可在 ElevenAgents 使用,以及 ElevenLabs 在荷蘭和比利時推出服務的消息。

  20. Cohere 產品與研究博客65

    Cohere Labs 分析 ATE 數據集:696,291 項 MCP 工具中,僅 2.6% 可端到端執行已記錄職業任務

    Cohere Labs 公開 Agentic Task Ecosystem(ATE)數據集,分析智能體工具對職業任務的自動化覆蓋。數據集收錄 696,291 項來自 123,069 個公開 MCP 伺服器的工具;按嚴格標準,僅 2.6% 能端到端執行已記錄的職業任務,923 個職業中有 419 個沒有任何智能體工具活動。