跳到正文

全部動態

今日 435 條
5月5日週二
  1. Manus:Blog50

    Manus 推出對話中的連接器推薦與啟用功能

    Manus 現可在對話中識別任務所需但尚未啟用的連接器,經用户確認後協助啟用並繼續完成任務。若連接器需要登入或額外授權,用户仍須完成相應流程,Manus 不會繞過權限控制。此功能目前適用於所有 Manus 任務,並支援流動端。

5月4日週一
5月1日週五
  1. OpenAI:失準報告與通報76

    OpenAI 説明 Auto-review 如何在無同步人工監督下審核 Codex 越界操作

    OpenAI 上週在 Codex 推出 Auto-review,由另一個 Codex Agent 審核越過沙盒邊界的操作,取代該處的用戶審批。Codex 工作階段因等待人工批准而暫停的頻率,約為手動審批模式的 1/200;需審查的操作約 99% 獲批准。OpenAI 提醒,Auto-review 並非安全保證,紅隊測試曾發現它可能被誤導,因而批准原本需經用戶批准的命令。

    推薦理由:文章以 Codex 內部部署和安全評測呈現 Auto-review 在減少人工中斷與審核越界操作之間的設計取捨,並交代其安全限制。

4月30日週四
  1. Google DeepMind60

    Google DeepMind 宣佈 AI co-clinician 醫療研究計劃,探索醫療協作模式

    Google DeepMind 宣佈 AI co-clinician 研究計劃,探索讓 AI 在醫生專業監督下協助患者照護。在 98 個基層醫療問題的評估中,97 個案例錄得零項嚴重錯誤;在開放式藥物問答中,系統表現勝過可用的前沿 AI 系統。

    推薦理由:文章並列呈現 AI co-clinician 在證據整理、藥物問答和多模態問診的測試結果,並以醫生整體表現較佳界定其臨牀輔助定位。

  2. Manus:Blog72

    Manus 介紹 Cloud Computer,降低建置全天候自動化的門檻

    Manus 介紹 Cloud Computer,讓 Bot、Python 腳本及軟體在專屬雲端機器上 24/7 運行。與會話結束即消失的標準沙盒不同,它會持續運作並保留檔案及已安裝工具,適合 24/7 Bot、定時任務、持久資料庫及自託管開源工具。每項任務仍從臨時沙盒開始,Manus 再按任務需要決定是否使用 Cloud Computer。

4月29日週三
  1. Hugging Face Blog61

    Granite 4.1 LLM 如何構建:預訓練、微調與強化學習流程

    Granite Team(IBM)詳述 Granite 4.1 的 3B、8B 和 30B 模型構建流程,涵蓋預訓練、監督式微調和多階段強化學習。預訓練以約 15T tokens 分五階段進行,並將上下文窗口擴至最高 512K tokens;其後以約 4.1M 經整理樣本作微調,採用 on-policy GRPO 配合 DAPO loss 進行強化學習。

    推薦理由:文章梳理 Granite 4.1 從約 15T tokens 預訓練、約 4.1M 樣本微調到多階段強化學習的流程,呈現 dense 模型的訓練設計取捨。

  2. Manus:Blog58

    Manus Slides 上線 GPT Image 2 圖像生成模型

    Manus 在 Manus Slides 上線 GPT Image 2,將 OpenAI 的圖像生成模型接入演示文稿工作流程。Manus 稱模型可提供 4K 照片級真實感解像度、近乎完美的文字渲染及進階空間推理,並支援局部編輯幻燈片文字和視覺元素。該功能向所有用户開放,可在生成設定中選擇 GPT Image 2。

4月28日週二
  1. Hugging Face Blog72

    NVIDIA 發佈 Nemotron 3 Nano Omni 長上下文多模態模型,面向文件分析、音訊與影片理解及智能體電腦操作

    NVIDIA 發佈 Nemotron 3 Nano Omni,這款長上下文多模態模型面向文件分析、音訊與影片理解、智能體電腦操作及通用推理。

    推薦理由:文章並列 Nemotron 3 Nano Omni、Nemotron Nano V2 VL 與 Qwen3-Omni 的多項基準結果,另列系統效率數據,提供文件、影音和 GUI 任務的比較依據。

4月27日週一
  1. Mistral AI66

    Mistral AI 開放 Workflows 公開預覽,提供企業 AI 編排層

    Mistral AI 開放企業 AI 編排層 Workflows 公開預覽,讓開發者以 Python 編寫流程,並可發佈至 Le Chat 供組織成員觸發。Workflows 提供持久執行、Studio 逐步追蹤及人工審批暫停與恢復,並支援將 workers 和資料處理部署在企業自有環境。

    推薦理由:Workflows 將持久執行、Studio 追蹤與人工審批整合,並支援 workers 在企業自有環境運行,呈現企業 AI 流程走向生產的部署設計。

  2. Google DeepMind58

    Google DeepMind 宣佈與韓國科學技術情報通信部(MSIT)建立合作夥伴關係

    Google DeepMind 宣佈與韓國科學技術情報通信部(MSIT)建立合作夥伴關係,支持韓國 AI 科研、人才培育及安全研究。Google 將在首爾辦公室設立 AI Campus,並探索與首爾大學(SNU)、韓國科學技術院(KAIST)等機構合作,在生命科學、能源、天氣與氣候等領域運用 AI for Science 模型。

4月24日週五
4月23日週四
  1. Hugging Face Blog62

    如何在 Chrome 擴充功能中使用 Transformers.js:Manifest V3 架構指南

    Hugging Face Blog 提供 Transformers.js 在 Chrome Manifest V3 擴充功能中運行本地 AI 的實作指南。範例將模型初始化、推理和工具執行集中在背景 service worker,側邊欄提供聊天介面,content script 負責網頁內容擷取及元素標記。

    推薦理由:文章拆解 Manifest V3 擴充功能內模型推理、對話狀態與頁面操作的分工,並説明背景 service worker 如何協調模型載入、工具執行與介面訊息。

  2. Google Research73

    Google Photos 在 Auto frame 中推出照片視角重構功能

    Google Photos 的 Auto frame 現已提供照片視角重構功能,會自動調整相機視點並補全原照片未拍到的畫面區域。方法先估算 3D 點圖與相機參數,再以生成式潛在擴散模型補全重新渲染後的空缺。這項功能會處理符合條件且包含人物的照片,重構版本列為 Auto frame 候選中的第二個版本。

    推薦理由:文章説明它如何把照片視為 3D 場景,重設相機位置並補出鏡頭外內容,呈現傳統裁切和縮放無法做到的視角修正。

4月22日週三
4月21日週二
  1. Google DeepMind51

    Google DeepMind 與 Accenture、Bain & Company、BCG、Deloitte 及 McKinsey 合作加速企業 AI 轉型

    Google DeepMind 宣佈與五家全球企業顧問公司合作,協助各行業大規模採用前沿 AI,推進 AI 驅動的企業轉型。合作方包括 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey,工作聚焦金融、製造、零售、媒體與娛樂等行業,涵蓋行業專屬 AI 能力開發及包括 Gemini 系列在內的前沿模型早期使用。