跳到正文

#產品更新

今日 1 條
1月30日週五
  1. Google DeepMind68

    Project Genie:用實驗原型探索無限互動世界

    Google DeepMind 開始向美國年滿 18 歲的 Google AI Ultra 訂户逐步開放 Project Genie;這款由 Genie 3、Nano Banana Pro 和 Gemini 驅動的實驗研究原型,可建立、探索及改編互動世界。

    推薦理由:原型把世界草圖、即時探索與改編放進同一體驗,並交代生成時長、物理表現和角色操控限制,可看出目前互動世界模型的使用方式與邊界。

1月29日週四
  1. Hugging Face Blog58

    Gradio 團隊推出 Daggr,讓 AI 工作流程可程式化串接並視覺化檢查

    Gradio 團隊推出開源 Python 函式庫 Daggr,可用程式串接 Gradio 應用、ML 模型及自訂函數,建立 AI 工作流程。Daggr 會自動生成視覺畫布,供使用者檢視中間輸出、修改輸入並單獨重跑步驟,同時保存工作流程狀態。該工具目前處於 beta,更新期間仍可能發生本機保存資料遺失。

1月28日週三
1月27日週二
1月22日週四
1月20日週二
1月16日週五
  1. OpenAI News76

    ChatGPT Go 現已全球推出

    OpenAI 宣佈 ChatGPT Go 現已全球開放,提供 GPT-5.2 Instant 的擴大使用權限、更高使用上限及更長記憶。OpenAI 表示,ChatGPT Go 令全球使用進階 AI 更可負擔。

    推薦理由:全球開放與 GPT-5.2 Instant 使用權限、使用上限和記憶長度的變化,呈現 ChatGPT Go 擴大可用性的具體內容。

1月14日週三
  1. Google DeepMind72

    Veo 3.1 Ingredients to Video 更新,提升影片一致性與創意並加入原生直向及 1080p、4K 輸出

    Google DeepMind 更新 Veo 3.1 Ingredients to Video,提升參考圖像生成影片的一致性與表現,並加入原生 9:16 直向輸出及 1080p、4K 升頻。

    推薦理由:更新同時處理參考圖像影片中的角色、背景與物件一致性,並加入原生直向及高解像度輸出,可看出 Veo 3.1 如何覆蓋短片創作與專業製作需求。

1月8日週四
1月7日週三
12月18日週四
  1. Hugging Face Blog65

    Transformers v5 重設分詞器架構,提升透明度與模組化

    Transformers v5 將分詞器架構與訓練所得的詞彙、合併規則分離,並在類別中明確呈現正規化器等組件。相較 v4 每個模型各有 slow/fast 兩套實作,v5 改為每個模型一個檔案,預設採用 Rust-based TokenizersBackend;分詞器類別亦可直接實例化並用自有語料訓練。

    推薦理由:文章對照 v4 與 v5,説明分離分詞器架構和訓練詞彙後,如何更直接檢查組件,並沿用模型架構訓練自訂分詞器。

12月17日週三
  1. OpenAI News34

    OpenAI 推出面向新聞機構的 OpenAI Academy

    OpenAI 推出與 American Journalism Project 及 The Lenfest Institute 共同建立的 OpenAI Academy for News Organizations,協助新聞編輯室有效運用 AI。學院提供培訓、實用案例及負責任使用指引,支援記者、編輯和出版商在報道及營運中採用 AI。

  2. OpenAI News69

    OpenAI 開放開發者提交 ChatGPT 應用,獲批後列入產品內目錄

    OpenAI 現已開放開發者提交應用,供 ChatGPT 審核及發布;獲批應用會出現在新的產品內目錄,方便用户發現。更新的工具、指南和 Apps SDK 可協助開發者構建原生於聊天的體驗,把現實世界操作帶入 ChatGPT。

    推薦理由:這項更新交代了 ChatGPT 應用提交審核、獲批發布及目錄展示的流程,並列出供開發者使用的工具、指南和 Apps SDK。

12月11日週四
  1. Hugging Face Blog68

    llama.cpp server 新增路由模式,支援無需重啟切換多個模型

    llama.cpp server 現已提供 router mode,可在不重啟的情況下動態載入、卸載及切換多個模型。它會從 llama.cpp 快取或指定的 --models-dir 尋找 GGUF,並在收到請求時載入模型;達到 --models-max 上限時按 LRU 卸載,預設最多同時載入 4 個模型。各模型以獨立程序運行,一個模型崩潰不會影響其他模型。

    推薦理由:多進程隔離配合按需載入和 LRU 卸載,展示 llama.cpp 如何在同一服務中管理多個模型並限制同時載入數量。

12月10日週三
12月9日週二
12月8日週一
12月5日週五
12月4日週四
  1. Hugging Face Blog72

    Hugging Face Skills 讓 Claude Code 微調開源大語言模型

    Hugging Face Skills 讓 Claude Code 等編碼智能體透過對話處理模型微調,涵蓋資料集驗證、GPU 選擇、雲端工作提交與進度監控。它亦兼容 Codex 和 Gemini CLI;文中以 Qwen3-0.6B 在 open-r1/codeforces-cots 上進行 SFT 為例,估算使用 t4-small 約需 20 分鐘、成本約 $0.30。

    推薦理由:文章將資料集驗證、GPU 選擇、雲端工作提交與進度監控串成智能體訓練流程,並比較 SFT、DPO、GRPO 的適用場景。

12月1日週一
11月26日週三
11月25日週二
  1. Hugging Face Blog47

    OVHcloud 成為 Hugging Face Hub 支援的推理服務提供商

    OVHcloud 已成為 Hugging Face Hub 支援的推理服務提供商,用户可透過 Hub 模型頁面及 JS、Python SDK 使用其服務。OVHcloud AI Endpoints 是全託管無伺服器服務,每百萬個 tokens 收費由 €0.04 起,基建設於歐洲數據中心。服務支援結構化輸出、函數呼叫及文字和圖像處理,首個 token 回應時間低於 200ms。

11月24日週一
11月20日週四
  1. Google DeepMind66

    Google DeepMind 如何將 AI 圖像驗證功能帶入 Gemini App

    Google DeepMind 在 Gemini App 推出 AI 圖像驗證功能,使用 SynthID 水印判斷圖片是否由 Google AI 生成或編輯。用户可上載圖片並直接提問;SynthID 自 2023 年推出以來,已為超過 20 billion 件 AI 生成內容加上水印。

    推薦理由:文章交代 Gemini 如何透過 SynthID 水印檢查圖像是否由 Google AI 生成或編輯,並説明後續支援影片、音訊及更多介面的計劃。

11月19日週三
  1. OpenAI News65

    ChatGPT for Teachers 為經核實的美國 K–12 教育工作者提供免費安全工作空間

    OpenAI 的 ChatGPT for Teachers 為經核實的美國 K–12 教育工作者提供免費安全工作空間,免費期限至 2027 年 6 月。工作空間設有教育級私隱保護和管理員控制。

    推薦理由:免費方案面向經核實的美國 K–12 教育工作者,期限至 2027 年 6 月,讀者可據此辨認服務對象和使用期限。

  2. Google DeepMind81

    Google 發佈 Antigravity 智能體開發平台,免費開放公開預覽

    Google 推出 Antigravity 智能體開發平台,並免費開放公開預覽。平台保留 AI IDE 編輯器,另設以智能體為核心的 Manager,支援瀏覽器控制及非同步互動,讓智能體自主規劃和執行端到端軟件任務;Artifacts 可供使用者檢視工作成果並提供回饋。

    推薦理由:Antigravity 將 IDE 編輯與 Agent Manager 分成不同工作介面,並以任務級 Artifacts、驗證結果和非同步回饋呈現及修正智能體工作。

  3. Google Research77

    Google Research 介紹生成式 UI:為各類提示生成客製化視覺互動體驗

    Google Research 介紹生成式 UI 實作,Gemini app 今日起推出 dynamic view 和 visual layout 兩項實驗,Google Search 的 AI Mode 亦加入生成式互動介面。

    推薦理由:文章對照生成式 UI 與標準 LLM 輸出及專家設計網站的偏好結果,並交代生成有時需一分鐘以上及輸出偶有不準確的限制。

11月13日週四
11月12日週三
10月30日週四
10月28日週二
10月27日週一