Mistral OCR 4 發佈,新增文件區塊定位、分類與信心分數
Mistral AI 發佈文件解析模型 Mistral OCR 4,除提取文字外亦輸出邊界框、區塊類型和信心分數,並支援 170 種語言、10 個語言組別。獨立人工偏好評估的平均勝率為 72%,模型在 OlmOCRBench 得分 85.20;官方提醒自動基準存在評分侷限,建議以自有文件評估。
推薦理由:文章列明 OCR 4 的結構化輸出和自動基準評分侷限,為企業按自身文件評估解析、檢索及資料管線提供具體參照。
Mistral AI 發佈文件解析模型 Mistral OCR 4,除提取文字外亦輸出邊界框、區塊類型和信心分數,並支援 170 種語言、10 個語言組別。獨立人工偏好評估的平均勝率為 72%,模型在 OlmOCRBench 得分 85.20;官方提醒自動基準存在評分侷限,建議以自有文件評估。
推薦理由:文章列明 OCR 4 的結構化輸出和自動基準評分侷限,為企業按自身文件評估解析、檢索及資料管線提供具體參照。
OpenAI 為 ChatGPT Enterprise 推出全新用量分析及更新版支出控制。這些功能協助機構管理成本,並更有信心地擴展 AI。
OpenAI 推出 Partner Network,並投入 $150M 支援全球合作夥伴。這項計劃旨在加快企業 AI 的採用、部署與轉型。
Hugging Face Blog 第二篇 PyTorch 效能分析教程,從 nn.Linear 追蹤至 GeGLU MLP。
推薦理由:文章對比 eager、torch.compile 與 Liger,展示 MLP 融合如何減少 HBM 往返,以及固定形狀特化與跨形狀通用的取捨。
OpenAI 開放企業透過 Oracle Cloud 使用 OpenAI 模型與 Codex,並可利用現有承諾建構及部署 AI。此方式涵蓋企業安全與治理。
LSEG 使用 OpenAI,在全球業務中擴大可信 AI 的應用規模。此舉加速洞察產出、縮短發布週期,並賦能 4,000 名員工。
Hugging Face Blog 示範如何把 GitHub Actions 的 CI 工作交由 Hugging Face Jobs 執行,並以 Trackio 展示透過臨時 self-hosted runner 連接兩者的方式。
推薦理由:文章給出 GitHub Actions 接入 Hugging Face Jobs 的操作流程,並説明 workflow 標籤設定。
NVIDIA 發佈 Nemotron 3.5 Content Safety,將多模態輸入、多語言覆蓋、自訂企業政策與可審計推理整合至單一 4B 模型。模型基於 Google Gemma 3 4B IT,明確訓練覆蓋 12 種語言,並承接其約 140 種語言的 zero-shot 泛化;可選 THINK mode 會輸出推理軌跡。
推薦理由:Nemotron 3.5 將多模態判定、自訂政策和可審計推理整合於 4B 模型,並附訓練資料集,提供企業安全審核的部署參考。
一位銷售主管透過 Manus 建立工作流程,將 HubSpot 資料整合至團隊使用的 Gmail 和 Slack,讓銷售代表可在收件匣掌握潛在客户及交易資訊。Gmail 郵件會按 HubSpot 資料加上標籤,瀏覽器擴充功能顯示相關線索或客户詳情;企業線索需要關注時,Slack 機械人會通知團隊。
H Company 發佈 Holo3.1 電腦操作模型系列,擴展至網頁、桌面及手機環境,並提供本地推理量化權重。AndroidWorld 上,35B-A3B 模型的分數由 67% 升至 79.3%,4B 和 9B 版本由 58% 升至 72%。
推薦理由:文章同時列出不同尺寸、量化格式,以及 AndroidWorld 和 DGX Spark 數據,讀者可據此比較本地部署的性能與速度取捨。
OpenAI 已在密歇根州為 Stargate 旗下 1GW 數據中心項目動工,以建設 AI 基礎設施。項目旨在擴大 AI 可及性、創造就業並支持當地社區。
推薦理由:可從項目規模及所列目標理解 Stargate 在密歇根州的基礎設施規劃,涵蓋擴大 AI 可及性、創造就業和支持社區。
OpenAI 宣佈,其前沿模型與 Codex 現已在 AWS 正式提供,為企業提供透過既有 AWS 環境使用 OpenAI 的途徑。企業可沿用熟悉的 AWS 控制措施及採購流程,並加快由評估走向生產。
推薦理由:這項可用性變化讓企業沿用既有 AWS 環境、控制措施及採購流程接入 OpenAI,並加快由評估推進至生產。
Hugging Face Blog 發佈 PyTorch 效能分析系列首篇入門指南,示範 torch.profiler 的設定,以及 profiler 表格和 CPU、GPU 軌跡的讀法。
推薦理由:文章以矩陣乘加示範如何結合 profiler 表格與 CPU、GPU 軌跡辨認瓶頸,並區分調度層融合與實際 GPU kernel 融合。
Google將新型密碼學聚合協定與可信執行環境(TEE)結合,為私隱分析建立零信任防護,確保Google只能取得匿名化的羣體彙總洞察。新協定讓裝置以單一訊息提交資料,免須在多輪互動期間持續在線;密碼學層確保個人原始資料不會在任何伺服器記憶體中暴露或重建。
Hugging Face 梳理 AI 智能體常見術語,解釋 Model、Scaffolding、Harness、Agent 等概念及其區別。文中將 Harness 定義為調用模型、處理工具調用及決定何時停止的執行層,Scaffolding 則涵蓋系統提示詞、工具描述、回應解析和上下文管理等行為定義層。
推薦理由:文章以模型、Scaffolding、Harness 與 Agent 的分工建立實用心智模型,並把這套脈絡延伸至訓練術語,便於理解智能體系統的組成與相關討論。
PaddleOCR 3.5 為支援的 OCR 與文件解析模型加入 Transformers 推理後端,開發者可透過 `engine` 參數選擇。`engine_config` 可設定 dtype、裝置配置及 attention implementation;若優先考慮 OCR 或文件解析吞吐量,文章通常建議使用預設的 paddle_static 後端。
OpenAI 與 Dell 合作,將 Codex 帶進混合式及本地部署企業環境。合作協助企業跨數據與工作流程安全部署 AI 編碼智能體。
Sebastian Raschka 梳理 Gemma 4、Laguna XS.2、ZAYA1-8B 和 DeepSeek V4 的架構改動,聚焦降低長上下文處理成本的設計。
OpenAI 為 Codex 在 Windows 上構建安全有效的沙盒,支援 Codex 在 Windows 上運行。沙盒設有受控檔案存取及網絡限制。
企業透過信任、治理、工作流程設計及規模化品質,推動 AI 從早期試驗走向影響力持續累積。
OpenAI 推出新企業部署公司 DeployCo,旨在協助組織將前沿 AI 投入生產,並轉化為可衡量的業務成果。
Manus Website Builder 的 Make a Copy 功能可將現有 WebDev 項目複製到新的獨立工作階段,讓用户在不影響原項目的情況下修改和測試。副本會保留最新檢查點或提交的完整程式碼庫、資料庫結構及密鑰和值,並只帶入簡短對話摘要。資料庫資料行、自訂網域設定和 GitHub 連線不會轉移,副本初始狀態為未發佈。
OpenAI 透過沙箱、審批、網絡政策及智能體原生遙測,安全運行 Codex。這些措施支援安全且合規地採用編碼智能體。
Berkeley AI Research 梳理自適應並行推理(Adaptive Parallel Reasoning,APR)的研究進展,將其界定為模型在推理時自行決定何時並行、分配多少執行緒及如何協調控制流的範式。
OpenAI 推出 MRC(Multipath Reliable Connection),這項新型超級電腦網絡協定旨在提升大規模 AI 訓練叢集的韌性與效能。MRC 透過 OCP 發佈。
Claude Platform 推出 Workload Identity Federation,讓工作負載使用自有身份提供者簽發的短期 OIDC token 向 Claude API 驗證身份,取代長期靜態 API key。用戶可在 Claude Console 設定發行者與聯邦規則,SDK 會自動處理 token 交換與更新。
OpenAI 重建 WebRTC 技術堆疊,為即時語音 AI 提供低延遲及全球規模支援,並支援流暢的對話輪替。
Manus 介紹 Cloud Computer,讓 Bot、Python 腳本及軟體在專屬雲端機器上 24/7 運行。與會話結束即消失的標準沙盒不同,它會持續運作並保留檔案及已安裝工具,適合 24/7 Bot、定時任務、持久資料庫及自託管開源工具。每項任務仍從臨時沙盒開始,Manus 再按任務需要決定是否使用 Cloud Computer。
OpenAI 擴大 Stargate 規模,新增數據中心容量以建設支撐 AGI 的算力基礎設施。新增容量旨在滿足持續增長的 AI 需求。
Hugging Face Inference Providers 現已支援 DeepInfra,初期提供對話與文本生成,可使用 DeepSeek V4、Kimi-K2.6、GLM-5.1 等開放權重 LLM。
OpenAI 的 ChatGPT Enterprise 與 OpenAI API 現可在 FedRAMP Moderate 授權下使用,支援美國聯邦機構安全採用 AI。
Mistral AI 開放企業 AI 編排層 Workflows 公開預覽,讓開發者以 Python 編寫流程,並可發佈至 Le Chat 供組織成員觸發。Workflows 提供持久執行、Studio 逐步追蹤及人工審批暫停與恢復,並支援將 workers 和資料處理部署在企業自有環境。
推薦理由:Workflows 將持久執行、Studio 追蹤與人工審批整合,並支援 workers 在企業自有環境運行,呈現企業 AI 流程走向生產的部署設計。
DeepSeek API 現已支援 V4-Pro 和 V4-Flash。兩款模型可透過 OpenAI ChatCompletions 介面及 Anthropic 介面使用,base_url 維持不變,model 參數應設為 deepseek-v4-pro 或 deepseek-v4-flash。
Factory 的 Automated QA 技能由 Droid 在每次推送時按真實用戶方式測試應用程式,並在 PR 留下附有測試證據的結構化報告。團隊可將 CI 設為可選檢查,或在 Droid 工作階段執行 `/qa` 本機測試;`/install-qa` 會按專案設定生成 QA 技能。Automated QA 現已提供予所有 Factory 方案。
OpenAI 的 API 部署清單建議以 Responses API 為起點,並按代表性任務比較任務成功率、延遲、token 用量及每項成功任務成本。清單涵蓋 reasoning.effort、工具調用、多智能體、快取與背景任務等配置,並説明 safety_identifier、misalignment 違規及 429/503 錯誤處理。
OpenAI 更新 Agents SDK,加入原生沙盒執行與模型原生 harness。這些更新旨在協助開發者構建可跨文件和工具運作的安全、長時間運行智能體。
推薦理由:更新把原生沙盒執行和模型原生 harness 納入 Agents SDK,呈現其對安全、長時間運行智能體跨文件與工具工作的支持。
OpenAI 為金融服務機構提供 AI 資源,包括提示詞套件、GPTs、指南及工具,協助機構安全部署並擴展 AI。
Overworld 推出 Waypoint-1.5 即時影片世界模型,提升視覺保真度並擴大可本地運行的硬件範圍。桌面硬件 RTX 3090 至 5090 可生成最高 720p、60 FPS 的即時環境;另有面向更廣泛消費級硬件(包括遊戲筆電)的 360p 版本,Apple Silicon Mac 支援即將推出。
推薦理由:Waypoint-1.5 分設 720p 與 360p 檔位,並列明 RTX 3090 至 5090 可達最高 720p、60 FPS,呈現其畫質與本地硬件覆蓋方案。
Gradio 介紹 gradio.Server,讓自訂前端可使用 Gradio 的後端能力,同時採用自選的前端框架。gradio.Server 擴展 FastAPI,提供自訂路由等功能,並加入 Gradio 的佇列、SSE 串流、並發控制和 gradio_client 相容性。
推薦理由:文章以圖像去背示例展示如何讓自訂 HTML/CSS/JS 前端透過 gradio.Server 使用 Gradio 佇列、並發控制與 ZeroGPU,提供兼顧介面自由度和後端管理的實作參考。
Granite 4.0 3B Vision 現已推出,是面向企業文件理解的緊湊型視覺語言模型,支援表格抽取、圖表理解及語義鍵值對抽取。模型以 LoRA adapter 形式構建於 Granite 4.0 Micro 之上,可獨立使用或配合 Docling,並以 Apache 2.0 授權在 Hugging Face 提供。