跳到正文

#Agent

今日 159 條
10月23日週四
  1. Hugging Face Blog62

    Meta 與 Hugging Face 推出 OpenEnv Hub,發布 OpenEnv 0.1 Spec(RFC)

    Meta 與 Hugging Face 合作推出 OpenEnv Hub,供開發者建立、分享和探索可用於訓練與部署的智能體環境。OpenEnv 以沙盒封裝任務所需工具、API、憑證及執行上下文,並提供清晰語義與隔離控制;團隊同時發布 OpenEnv 0.1 Spec(RFC)徵求社羣意見。

    推薦理由:OpenEnv 將智能體任務所需的工具、API、憑證與執行上下文封裝成可分享環境,並銜接訓練和部署,呈現環境規格化的實際用途。

10月22日週三
10月16日週四
10月6日週一
9月29日週一
9月26日週五
  1. Hugging Face Blog48

    swift-transformers 升至 1.0,並展望未來

    Hugging Face 的 Swift 函式庫 swift-transformers 發佈 1.0,標誌套件進入穩定階段,並為後續功能迭代奠定基礎。Tokenizers 和 Hub 現已成為頂層模組,套件亦採用支援有狀態模型的 Modern Core ML API,並完整支援 Swift 6。團隊表示,後續將聚焦 MLX 與智能體應用。

9月22日週一
  1. Hugging Face Blog68

    Gaia2 智能體基準與 ARE 框架推出,支援複雜互動評測

    Hugging Face 推出 Gaia2 智能體基準及 Meta Agents Research Environments(ARE)框架,用於在更複雜、接近真實情境的環境中執行、除錯和評估智能體。

    推薦理由:Gaia2 將智能體評測從唯讀檢索擴展至含模糊指令、時間要求和環境故障的互動任務,ARE 記錄執行 traces,便於分析智能體在複雜情境中的失誤。

9月15日週一
  1. OpenAI News63

    OpenAI 在 GPT-5 系統卡補充説明中介紹 GPT-5-Codex

    OpenAI 在 GPT-5 系統卡補充説明中介紹 GPT-5-Codex,這是針對 Codex 中 AI 智能體編碼進一步優化的 GPT-5 版本。它會按任務複雜度動態調整思考投入,簡單對話查詢或小任務回應較快,複雜任務則獨立工作更長時間。

    推薦理由:補充説明交代 GPT-5-Codex 面向 Codex 中的 AI 智能體編碼,並説明它如何按任務複雜度調整思考投入。

8月21日週四
8月12日週二
8月5日週二
  1. OpenAI Developers76

    如何用 Ollama 在本地運行 OpenAI gpt-oss

    OpenAI 介紹用 Ollama 在本地運行兩款 gpt-oss 模型,支援離線聊天、API 調用及接入 Agents SDK。gpt-oss-20b 建議至少 16GB VRAM 或 unified memory,gpt-oss-120b 至少 60GB;模型預設採用 MXFP4 量化,VRAM 不足時可用 CPU,但速度較慢。

    推薦理由:指南比較兩個模型所需的硬件配置,並串起本地聊天、Chat Completions API 與 Agents SDK 接入步驟,便於評估本地部署路徑。

8月3日週日
7月31日週四
  1. Hugging Face Blog62

    用 Python 實作 MCP 伺服器:以 Gradio 建立 AI 購物助手

    文章示範如何以 Gradio 在 Python 中實作 MCP 伺服器,並建立可瀏覽服裝網站、呼叫 IDM-VTON 虛擬試穿的 AI 購物助手。Gradio 會把應用程式的 API endpoint 自動轉為具名稱、描述及輸入 schema 的 MCP 工具,並支援即時進度通知和自動檔案上傳。

    推薦理由:示例將 Gradio MCP 伺服器、Playwright 網頁瀏覽與 IDM-VTON 虛擬試穿串成工作流程,並列出 VS Code 設定步驟。

  2. Manus:Blog66

    Manus 推出 Wide Research,支援大規模研究任務

    Manus 推出 Wide Research,讓用户處理需要蒐集數百個項目資料的複雜大型任務。它以通用 Manus 實例作為子智能體,構成系統級並行處理機制及智能體間協作協議。目前正式向 Pro 用户推出,並計劃逐步開放予 Plus 和 Basic 層級用户。

7月30日週三
7月23日週三
7月21日週一
  1. OpenAI Developers61

    OpenAI 語音應用入門:三種語音智能體架構的選擇與評估

    OpenAI 語音應用指南介紹三種語音智能體架構:GPT-Live 搭配獨立後端、Realtime API 在單一會話中處理語音、推理與工具使用,以及可逐階段檢視或替換元件的串接式語音管線。指南列出任務與工具結果、對話時序、語音與語言、會話可靠性等評估面向,並建議以 Crawl、Walk、Run 逐步增加測試複雜度。

  2. OpenAI Developers58

    OpenAI Python SDK 如何編排多個智能體

    OpenAI 的 Python SDK 指南介紹多智能體編排的兩種方式,即由 LLM 規劃和決策,或由程式碼控制流程,兩者也可混合使用。SDK 常見模式包括由管理者 Agent 透過 `Agent.as_tool()` 調用專家,或由分流 Agent 透過 handoffs 將對話交給專家接手當前回合。

  3. OpenAI Developers6

    Agents SDK:解鎖智能體能力

    OpenAI Developers 的 Agents SDK 頁面標題為「解鎖智能體能力」,但目前可見正文只有要求訪客確認真人身份的驗證提示。頁面另提示 vimeo.com 需要先檢查連線安全,沒有提供 SDK 的功能或技術細節。

7月18日週五
  1. OpenAI Developers59

    OpenAI 公開基於 Responses API 的客服 AI 智能體人機協作示例程式庫

    OpenAI 公開了一個基於 Responses API 的客服 AI 智能體人機協作示例程式庫,設有客户與人工客服兩種聊天介面。示例使用內置 file search 工具提供知識庫檢索和建議回覆,敏感操作由人工確認,非敏感操作可自動執行。示例中的函數目前只是佔位實現,不會實際修改資料;項目亦未達生產環境使用要求,用於生產環境前需補充輸入防護措施、用户身份驗證等安全措施。

  2. OpenAI Developers0

    OpenAI 即時智能體示範

    OpenAI Developers 的「Realtime agent demo」頁面只顯示要求確認使用者為真人的驗證提示,未載有示範內容。頁面並提示 vimeo.com 需先檢查連線安全,沒有提供模型名稱或其他技術細節。

  3. Manus:Blog66

    AI 智能體的上下文工程:Manus 的構建經驗與教訓

    Manus 團隊分享構建 Manus 的 AI 智能體上下文工程經驗,提出管理上下文、工具選擇與記憶的設計原則。文章建議保持提示詞前綴穩定、避免在迭代中動態增刪工具,並把檔案系統作為可恢復的外部記憶;另指出應在上下文中保留失敗記錄,並持續重述待辦目標。文中提到 Manus 平均輸入與輸出 token 比例約為 100:1,典型任務平均約有 50 次工具呼叫。

7月17日週四
  1. Mistral AI69

    Mistral AI 為 Le Chat 推出 Deep Research、語音等新功能

    Mistral AI 為 Le Chat 推出 Deep Research、語音、多語言推理、Projects 和圖片編輯等新功能。Deep Research(Preview)可搜尋可信來源並生成附參考資料的結構化報告,語音模式採用 Voxtral,多語言推理由 Magistral 驅動,圖片編輯則與 Black Forest Labs 合作。

    推薦理由:Le Chat 把研究、語音、多語言推理、Projects 與圖片編輯納入同一產品,呈現其如何覆蓋資訊整理、語音互動和圖像修改等不同任務。

7月11日週五
  1. OpenAI Developers57

    OpenAI Developers 的 AI 應用開發學習路線:從概念到生產環境

    OpenAI Developers 提供一套面向開發者的 AI 應用開發學習路線,按四階段涵蓋基礎概念、應用開發、測試與評估,以及規模化和維護。內容介紹如何透過 Responses API 或 Agents SDK 建置智能體,並説明 RAG 用於引入知識、微調用於調整模型行為,以及用 evals 和 guardrails 測試與約束應用。