跳到正文

#Agent

今日 161 條
4月30日週四
  1. Manus:Blog72

    Manus 介紹 Cloud Computer,降低建置全天候自動化的門檻

    Manus 介紹 Cloud Computer,讓 Bot、Python 腳本及軟體在專屬雲端機器上 24/7 運行。與會話結束即消失的標準沙盒不同,它會持續運作並保留檔案及已安裝工具,適合 24/7 Bot、定時任務、持久資料庫及自託管開源工具。每項任務仍從臨時沙盒開始,Manus 再按任務需要決定是否使用 Cloud Computer。

4月28日週二
  1. Hugging Face Blog72

    NVIDIA 發佈 Nemotron 3 Nano Omni 長上下文多模態模型,面向文件分析、音訊與影片理解及智能體電腦操作

    NVIDIA 發佈 Nemotron 3 Nano Omni,這款長上下文多模態模型面向文件分析、音訊與影片理解、智能體電腦操作及通用推理。

    推薦理由:文章並列 Nemotron 3 Nano Omni、Nemotron Nano V2 VL 與 Qwen3-Omni 的多項基準結果,另列系統效率數據,提供文件、影音和 GUI 任務的比較依據。

4月27日週一
  1. Mistral AI66

    Mistral AI 開放 Workflows 公開預覽,提供企業 AI 編排層

    Mistral AI 開放企業 AI 編排層 Workflows 公開預覽,讓開發者以 Python 編寫流程,並可發佈至 Le Chat 供組織成員觸發。Workflows 提供持久執行、Studio 逐步追蹤及人工審批暫停與恢復,並支援將 workers 和資料處理部署在企業自有環境。

    推薦理由:Workflows 將持久執行、Studio 追蹤與人工審批整合,並支援 workers 在企業自有環境運行,呈現企業 AI 流程走向生產的部署設計。

4月24日週五
4月23日週四
  1. Hugging Face Blog62

    如何在 Chrome 擴充功能中使用 Transformers.js:Manifest V3 架構指南

    Hugging Face Blog 提供 Transformers.js 在 Chrome Manifest V3 擴充功能中運行本地 AI 的實作指南。範例將模型初始化、推理和工具執行集中在背景 service worker,側邊欄提供聊天介面,content script 負責網頁內容擷取及元素標記。

    推薦理由:文章拆解 Manifest V3 擴充功能內模型推理、對話狀態與頁面操作的分工,並説明背景 service worker 如何協調模型載入、工具執行與介面訊息。

4月22日週三
4月21日週二
  1. Google DeepMind51

    Google DeepMind 與 Accenture、Bain & Company、BCG、Deloitte 及 McKinsey 合作加速企業 AI 轉型

    Google DeepMind 宣佈與五家全球企業顧問公司合作,協助各行業大規模採用前沿 AI,推進 AI 驅動的企業轉型。合作方包括 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey,工作聚焦金融、製造、零售、媒體與娛樂等行業,涵蓋行業專屬 AI 能力開發及包括 Gemini 系列在內的前沿模型早期使用。

4月17日週五
4月15日週三
  1. Hugging Face Blog68

    HCompany 推出 HoloTab Chrome 擴充功能,讓 AI 智能體代辦網頁任務

    HCompany 推出免費 Chrome 擴充功能 HoloTab,讓用户無需設定或技術技能,即可由 AI 智能體在瀏覽器中執行網站任務。用户可錄製操作並沿途講述目的,生成 routine 後再重跑或排程執行。HoloTab 已開放使用:https://chromewebstore.google.com/detail/holotab/hlaoiikljjgcjdhkakedfngifaopbcop

    推薦理由:HoloTab把網頁操作交給瀏覽器內的智能體,並以錄製操作、補充講述來生成可重跑或排程的流程,呈現重複網頁任務的自動化方式。

4月13日週一
4月8日週三
4月6日週一
  1. Manus:Blog51

    2026 年五款最佳桌面 AI 智能體

    文章比較 Manus My Computer、Perplexity Computer、Claude Cowork、ChatGPT Agent 和 Genspark 五款桌面 AI 智能體,涵蓋功能、價格及適用場景。文中説明各工具在本地檔案存取和雲端執行上的差異,並按研究、Microsoft Office 文件處理和網頁自動化等需求提供選擇建議。

  2. Manus:Blog65

    Manus 推出 Slack 整合,提供三種工作委派方式

    Manus 推出 Slack 整合,提供智能體私訊、頻道內標記 @manus,以及 Slack 連接器三種工作方式。智能體私訊可延續過往對話記憶;頻道內標記只處理當前話題且不具持久記憶,連接器則可代讀和發送 Slack 訊息。智能體預設不能讀取其他頻道,須連接器已連接並將 Manus 加入指定頻道;Slack 應用內 AI 集成功能需使用付費 Slack 套餐。

4月4日週六
  1. FireRedTeam:原創語音與多模態項目59

    FireRedTeam 發佈 FireRed-Image-Edit-1.1,優化人像一致性等編輯能力

    FireRedTeam 發佈 FireRed-Image-Edit-1.1,基於 FireRed-Image-Edit-1.0,優化人像一致性、多元素融合、風格化文字參照及人像妝效。內置 Agent 可自動處理超過 3 張輸入圖片的區域偵測、裁切拼接及提示詞改寫。項目提供的加速推理配置標示使用 30GB VRAM,生成約 4.5s/sample。

4月3日週五
4月2日週四
  1. Hugging Face Blog85

    Google DeepMind 發佈 Gemma 4 多模態模型系列,五種尺寸登陸 Hugging Face

    Google DeepMind 的 Gemma 4 多模態模型系列已登陸 Hugging Face,提供五種尺寸,支援圖像、文字及部分型號的音訊輸入。模型採 Apache 2 授權,最大上下文窗口為 256K;31B 和 26B A4B 的 text-only LMArena 估算分數分別為 1452 和 1441,後者有 4B 啟用參數。

    推薦理由:文章列出五種 Gemma 4 規格、上下文窗口和音訊支援差異,並整理多個推理與微調框架的接入方式,可供比較型號特點及部署路徑。

3月28日週六
  1. OpenAI:失準報告與通報51

    OpenAI 研究:對齊中訓練能泛化多遠?

    OpenAI 研究人員測試對齊中訓練在類似 o4-mini 的模型上能否泛化;模型經過推理後訓練後,這種訓練效果未能穩定延伸至較貼近現實的聊天及智能體評測。他們分別以 230k 份文件(約 340M tokens)進行對齊或失準中訓練,並與不加額外中訓練的基線比較;接近訓練分佈的問答評測呈現預期排序。聊天評測中,兩種中訓練結果大多相近;智能體評測未能明確區分三組模型,整體分數沒有顯著差異。

3月26日週四
  1. Hamel Husain 長文67

    數據科學家的反擊:LLM 時代評測仍需要數據科學方法

    Hamel Husain 認為,LLM API 雖讓團隊可自行整合 AI,評測、實驗設計和生產監測仍需要數據科學方法。文中列出五類評測陷阱,包括套用通用指標、未驗證 LLM 評審、測試集設計不當、數據及標籤質素欠佳,以及過度自動化。作者建議檢視 traces、以人工標註驗證評審,並根據真實生產數據設計測試集,讓領域專家參與標註。

3月25日週三
  1. Google Research62

    Google Research 推出 Vibe Coding XR,以 Gemini 和 XR Blocks 生成 Android XR 原型

    Google Research 宣佈 Vibe Coding XR,結合 Gemini 與 XR Blocks,將自然語言描述轉成具物理感知能力的 Android XR 應用,最快可在 60 秒內生成。

    推薦理由:文章展示如何以 XR Blocks 架構、範例模板和專用系統提示詞約束 Gemini,令自然語言生成的 XR 原型遵循既有 API 與互動設計規範。

  2. ARC Prize:官方博客68

    ARC Prize 發佈 ARC-AGI-3 互動式基準測試,評估智能體探索能力

    ARC Prize 發佈 ARC-AGI-3,這是 ARC-AGI 系列首個完全互動式基準,包含數百個互動環境和數千個遊戲式關卡。環境沒有指示、規則或明示目標,AI 智能體須自行探索並將所學帶到難度逐步提高的關卡。ARC Prize 2026 現已開放參賽,獎金超過 $2 million;人類得分為 100%,前沿 AI 得分為 0.51%。

3月24日週二
3月18日週三
  1. Manus:Blog50

    使用 Manus Connectors 連接 Instagram Creator Marketplace

    Manus 推出 Manus Connectors 的 Instagram Creator Marketplace 早期 Beta,將 Meta 官方創作者發掘工具接入 Manus 工作流程。連接器可搜尋和篩選超過 200 萬名創作者,並提供 Meta 認證的一方受眾與績效洞察,亦可把創作者發掘及外聯電郵草擬整合至自動化流程。功能目前在所有 Manus 市場提供,但不包括歐盟國家。

3月17日週二
  1. Manus:Blog66

    Manus 升級 Google Workspace 連接器,支援 Docs、Sheets、Slides 精細操作

    Manus 升級 Google Workspace 連接器,讓它可在 Docs、Sheets 和 Slides 中執行精細編輯與結構操作。升級使用 Google Workspace CLI,該開源工具由 Google Workspace 團隊在 GitHub 發佈,但並非 Google 官方支持的產品。新功能已向所有 Manus 用户開放,無需安裝或啟用,且不另收費;既有工作流維持不變。

3月16日週一
  1. Manus:Blog78

    Manus 推出桌面應用程式核心功能「我的電腦」,連接雲端智能體與本機資源

    Manus 推出桌面應用程式核心功能「我的電腦」,讓雲端智能體透過終端命令讀取、分析和編輯本機檔案,並啟動及控制本機應用程式。用户可新增並授權本機資料夾;執行每項命令前須明確批准,亦可選擇「始終允許」或「僅允許一次」。該功能現已向 macOS 和 Windows 用户開放。

    推薦理由:Manus 將雲端智能體延伸至本機檔案與應用程式,並透過命令授權讓自動化能力與用户對本機操作的控制並存。

3月11日週三
3月10日週二
  1. Hugging Face Blog70

    Hugging Face Hub 推出 Storage Buckets,提供可變的 S3 類物件儲存

    Hugging Face 在 Hub 推出 Storage Buckets,為頻繁變動的 ML 產物提供非版本化 S3 類物件儲存。Buckets 建基於 Xet,以分塊及跨檔案去重減少重複傳輸;Enterprise 計費按去重後的儲存量計算。

    推薦理由:文章交代 Buckets 與版本化倉庫分別承擔工作層和發布層,並説明 Xet 去重如何減少重複傳輸及 Enterprise 的計費儲存量。

3月6日週五
  1. Manus:Blog64

    2026 年最佳 AI 應用程式建構工具:以相同提示詞測試 7 個平台

    Manus 以相同的 Solace Studio 提示詞測試 7 個 AI 應用程式建構平台,並在文中將自家工具列為整體首選。測試中,Manus 從單一提示詞生成包含預約日曆、Stripe 付款及管理員面板的功能原型;Replit 也嘗試生成完整堆疊,但需具備一定技術經驗以作驗證和除錯。文章指出,多數其他平台先生成視覺介面,部分後端功能需要另行設定或手動構建。