OpenAI 與 PwC 合作,重新構想 CFO 職能
OpenAI 與 PwC 合作,協助企業運用 AI 智能體自動化財務工作流程,並推動 CFO 職能現代化。合作亦旨在改善預測及強化管控。
OpenAI 與 PwC 合作,協助企業運用 AI 智能體自動化財務工作流程,並推動 CFO 職能現代化。合作亦旨在改善預測及強化管控。
Manus 現可在對話中識別任務所需但尚未啟用的連接器,經用户確認後協助啟用並繼續完成任務。若連接器需要登入或額外授權,用户仍須完成相應流程,Manus 不會繞過權限控制。此功能目前適用於所有 Manus 任務,並支援流動端。
Jack Clark 根據公開研究與產品進展,估計到 2028 年底前,AI 系統自主訓練後繼模型、實現無人參與 AI 研發的機率約為 60%。他以 SWE-Bench 成績由 Claude 2 的約 2% 升至 Claude Mythos Preview 的 93.9%,以及 AI 在研究復現、模型微調和長時間任務上的進展,作為主要依據。
Claude Platform 推出 Workload Identity Federation,讓工作負載使用自有身份提供者簽發的短期 OIDC token 向 Claude API 驗證身份,取代長期靜態 API key。用戶可在 Claude Console 設定發行者與聯邦規則,SDK 會自動處理 token 交換與更新。
OpenAI 重建 WebRTC 技術堆疊,為即時語音 AI 提供低延遲及全球規模支援,並支援流暢的對話輪替。
OpenAI 上週在 Codex 推出 Auto-review,由另一個 Codex Agent 審核越過沙盒邊界的操作,取代該處的用戶審批。Codex 工作階段因等待人工批准而暫停的頻率,約為手動審批模式的 1/200;需審查的操作約 99% 獲批准。OpenAI 提醒,Auto-review 並非安全保證,紅隊測試曾發現它可能被誤導,因而批准原本需經用戶批准的命令。
推薦理由:文章以 Codex 內部部署和安全評測呈現 Auto-review 在減少人工中斷與審核越界操作之間的設計取捨,並交代其安全限制。
Google DeepMind 宣佈 AI co-clinician 研究計劃,探索讓 AI 在醫生專業監督下協助患者照護。在 98 個基層醫療問題的評估中,97 個案例錄得零項嚴重錯誤;在開放式藥物問答中,系統表現勝過可用的前沿 AI 系統。
推薦理由:文章並列呈現 AI co-clinician 在證據整理、藥物問答和多模態問診的測試結果,並以醫生整體表現較佳界定其臨牀輔助定位。
Ling-2.6-1T 正式開源,定位為面向複雜任務的萬億級綜合旗艦模型。
OpenAI Developers plugin 為 ChatGPT 和 Codex 提供 OpenAI Platform 接入、API 設定指引及智能體開發支援。
OpenAI 説明 GPT-5 行為中由個性驅動的怪異表現「哥布林輸出」如何擴散。內容交代其時間線、根本原因及修正措施。
Manus Blog 以同一份個人理財網站提示詞實測 Replit、Manus AI、Lovable、Vercel v0、Base44 和 Hostinger Horizons,並比較各工具的生成結果與使用體驗。
Manus 介紹 Cloud Computer,讓 Bot、Python 腳本及軟體在專屬雲端機器上 24/7 運行。與會話結束即消失的標準沙盒不同,它會持續運作並保留檔案及已安裝工具,適合 24/7 Bot、定時任務、持久資料庫及自託管開源工具。每項任務仍從臨時沙盒開始,Manus 再按任務需要決定是否使用 Cloud Computer。
Granite Team(IBM)詳述 Granite 4.1 的 3B、8B 和 30B 模型構建流程,涵蓋預訓練、監督式微調和多階段強化學習。預訓練以約 15T tokens 分五階段進行,並將上下文窗口擴至最高 512K tokens;其後以約 4.1M 經整理樣本作微調,採用 on-policy GRPO 配合 DAPO loss 進行強化學習。
推薦理由:文章梳理 Granite 4.1 從約 15T tokens 預訓練、約 4.1M 樣本微調到多階段強化學習的流程,呈現 dense 模型的訓練設計取捨。
OpenAI 擴大 Stargate 規模,新增數據中心容量以建設支撐 AGI 的算力基礎設施。新增容量旨在滿足持續增長的 AI 需求。
OpenAI 提出五部分行動計劃,旨在加強智能時代的網絡安全,重點是普及 AI 驅動的網絡防禦及保護關鍵系統。
Hugging Face Inference Providers 現已支援 DeepInfra,初期提供對話與文本生成,可使用 DeepSeek V4、Kimi-K2.6、GLM-5.1 等開放權重 LLM。
Manus 在 Manus Slides 上線 GPT Image 2,將 OpenAI 的圖像生成模型接入演示文稿工作流程。Manus 稱模型可提供 4K 照片級真實感解像度、近乎完美的文字渲染及進階空間推理,並支援局部編輯幻燈片文字和視覺元素。該功能向所有用户開放,可在生成設定中選擇 GPT Image 2。
NVIDIA 發佈 Nemotron 3 Nano Omni,這款長上下文多模態模型面向文件分析、音訊與影片理解、智能體電腦操作及通用推理。
推薦理由:文章並列 Nemotron 3 Nano Omni、Nemotron Nano V2 VL 與 Qwen3-Omni 的多項基準結果,另列系統效率數據,提供文件、影音和 GUI 任務的比較依據。
OpenAI 的 GPT models、Codex 與 Managed Agents 現已在 AWS 提供。OpenAI 表示,企業可在 AWS 環境建構安全 AI。
推薦理由:這項 AWS 上線交代了 OpenAI GPT models、Codex 與 Managed Agents 的可用範圍,也説明企業可在 AWS 環境建構安全 AI 的使用場景。
OpenAI 透過多項安全措施保障 ChatGPT 社羣安全。措施包括模型安全防護、濫用偵測、政策執行,以及與安全專家合作。
OpenAI 的 ChatGPT Enterprise 與 OpenAI API 現可在 FedRAMP Moderate 授權下使用,支援美國聯邦機構安全採用 AI。
Mistral AI 開放企業 AI 編排層 Workflows 公開預覽,讓開發者以 Python 編寫流程,並可發佈至 Le Chat 供組織成員觸發。Workflows 提供持久執行、Studio 逐步追蹤及人工審批暫停與恢復,並支援將 workers 和資料處理部署在企業自有環境。
推薦理由:Workflows 將持久執行、Studio 追蹤與人工審批整合,並支援 workers 在企業自有環境運行,呈現企業 AI 流程走向生產的部署設計。
Google DeepMind 宣佈與韓國科學技術情報通信部(MSIT)建立合作夥伴關係,支持韓國 AI 科研、人才培育及安全研究。Google 將在首爾辦公室設立 AI Campus,並探索與首爾大學(SNU)、韓國科學技術院(KAIST)等機構合作,在生命科學、能源、天氣與氣候等領域運用 AI for Science 模型。
OpenAI 與 Microsoft 宣佈修訂合作協議,以簡化雙方合作、增添長期明確性,並支持持續的大規模 AI 創新。
Choco 使用 OpenAI APIs 和 AI 智能體簡化食品分銷流程,提升生產力並促進業務增長。這則客户案例呈現 AI 在實際業務中的應用。
Sam Altman 分享了指引 OpenAI 工作的五項原則。OpenAI 的使命是確保 AGI 惠及全人類。
深度求索(DeepSeek)發佈 DeepSeek-V4,Pro、Flash 系列各有 instruct 與 base 版本,四款 checkpoint 均支援 1M-token 上下文。
推薦理由:文章把 KV cache 成本、混合注意力設計與智能體工作流串連起來,並以基準數據呈現長上下文能力在工具任務中的表現。
OpenAI 開源思維鏈可監測性評測套件中的多數數據集、計算 g-mean 2 的參考程式碼,以及一項新的交叉擬合篩選策略。開放版本涵蓋幹預、流程及結果屬性三類評測,依賴私人或受限制數據的部分項目未有公開;用於模擬評測的 scaffold 僅作示範,不獲支援。
DeepSeek API 現已支援 V4-Pro 和 V4-Flash。兩款模型可透過 OpenAI ChatCompletions 介面及 Anthropic 介面使用,base_url 維持不變,model 參數應設為 deepseek-v4-pro 或 deepseek-v4-flash。
OpenAI 介紹 GPT-5.5,這是一款面向跨工具複雜任務的模型,涵蓋編碼、研究與數據分析。
OpenAI 分享 ChatGPT Work 的實用工作流程,涵蓋日常工作的重複任務、更新、研究、規劃及團隊營運。
Hugging Face Blog 提供 Transformers.js 在 Chrome Manifest V3 擴充功能中運行本地 AI 的實作指南。範例將模型初始化、推理和工具執行集中在背景 service worker,側邊欄提供聊天介面,content script 負責網頁內容擷取及元素標記。
推薦理由:文章拆解 Manifest V3 擴充功能內模型推理、對話狀態與頁面操作的分工,並説明背景 service worker 如何協調模型載入、工具執行與介面訊息。
Factory 的 Automated QA 技能由 Droid 在每次推送時按真實用戶方式測試應用程式,並在 PR 留下附有測試證據的結構化報告。團隊可將 CI 設為可選檢查,或在 Droid 工作階段執行 `/qa` 本機測試;`/install-qa` 會按專案設定生成 QA 技能。Automated QA 現已提供予所有 Factory 方案。
Google Photos 的 Auto frame 現已提供照片視角重構功能,會自動調整相機視點並補全原照片未拍到的畫面區域。方法先估算 3D 點圖與相機參數,再以生成式潛在擴散模型補全重新渲染後的空缺。這項功能會處理符合條件且包含人物的照片,重構版本列為 Auto frame 候選中的第二個版本。
推薦理由:文章説明它如何把照片視為 3D 場景,重設相機位置並補出鏡頭外內容,呈現傳統裁切和縮放無法做到的視角修正。
OpenAI 向經核實的美國醫師、執業護士和藥劑師免費提供 ChatGPT for Clinicians。該服務支援臨牀照護、文書記錄和研究。
OpenAI 提供 ChatGPT 工作區智能體的建立及使用指南,可用於自動化可重複工作流程、連接工具並簡化團隊營運。
OpenAI 在 ChatGPT 推出 Workspace agents,這些由 Codex 驅動的智能體可在雲端自動化複雜工作流程。它們亦可協助團隊安全地透過不同工具擴展工作。
OpenAI 發佈 Privacy Filter,一款用於在文本中偵測及遮蔽個人身份識別資訊(PII)的開放權重模型。OpenAI 稱這款模型具備 state-of-the-art accuracy。公告網址為 https://openai.com/index/introducing-openai-privacy-filter。
Google DeepMind 宣佈與五家全球企業顧問公司合作,協助各行業大規模採用前沿 AI,推進 AI 驅動的企業轉型。合作方包括 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey,工作聚焦金融、製造、零售、媒體與娛樂等行業,涵蓋行業專屬 AI 能力開發及包括 Gemini 系列在內的前沿模型早期使用。
OpenAI 於 2026 年推出 ChatGPT Images 2.0,改進文字渲染,並提供多語言支援與視覺推理。頁面另提示讀者查看 Images 2.5 的新內容。
推薦理由:更新聚焦文字渲染、多語言支援和視覺推理,從三個具體面向呈現 ChatGPT Images 2.0 的更新重點。