Endava 如何利用 Codex 建構智能體組織
Endava 使用 Codex 建構智能體組織,以加快軟件交付,並將需求分析時間由數週縮短至數小時。
Endava 使用 Codex 建構智能體組織,以加快軟件交付,並將需求分析時間由數週縮短至數小時。
Cisco 與 OpenAI 藉助 Codex 重塑企業工程,協助 Cisco 擴展 AI 原生開發、加快 AI Defense 工作,並自動化缺陷修復。
OpenAI、Thrive 與 Crete 使用 Codex 構建自我改進的税務智能體,實現申報自動化、提升準確度並加快工作流程。
Mistral 推出 Mistral Medium 3.5 公開預覽,並以此支援 Mistral Vibe 雲端遠端編碼代理及 Le Chat 的 Work mode。
推薦理由:材料展示模型、雲端編碼代理與 Le Chat 多步驟工具流程的連接方式,能看出長程任務如何落入具體產品工作流。
Virgin Atlantic 使用 Codex,在固定的假日旅遊期限前交付改版流動應用程式。成果包括近乎全面的單元測試覆蓋率,以及零宗 P1 缺陷。
OpenAI 獲 Gartner 評為 2026 年企業級 AI 編碼智能體魔力象限的領導者。Codex 因創新及企業規模部署獲得認可。
Ramp 工程師使用 Codex 搭配 GPT-5.5 審查程式碼並交付改進,讓取得實質回饋的時間由數小時縮短至數分鐘。
Google Research 開放 ERA 科學研究工具,並開始逐步開放由 ERA 與 AlphaEvolve 構建的 Computational Discovery。
推薦理由:文章把 ERA 的樹狀搜尋方法與多學科基準和實際科學問題並置,呈現其從程式碼優化延伸至預測研究的應用範圍。
OpenAI 與 Dell 合作,將 Codex 帶進混合式及本地部署企業環境。合作協助企業跨數據與工作流程安全部署 AI 編碼智能體。
Google DeepMind 發佈 Gemini 3.5 模型系列,首款 Gemini 3.5 Flash 即日起透過 Gemini app 和 Google Search 的 AI Mode 向全球用户開放。
推薦理由:Gemini 3.5 Flash 列出代理任務、編碼及多模態基準成績,並比較每秒輸出 tokens 的速度,讓性能主張有多項指標可供對照。
Sea Limited 正在各工程團隊部署 Codex,以加快亞洲的 AI 原生軟件開發。其首席產品官闡述此舉背後的原因,並談及 Codex 與智能體軟件開發的未來。
OpenAI 讓用户透過 ChatGPT 手機應用程式跨裝置及遠端環境使用 Codex。用户可即時監看、調整及核准編碼任務。
推薦理由:這項更新把 Codex 編碼任務的監看、調整與核准延伸至 ChatGPT 手機應用程式,讓相關操作可跨裝置及遠端環境進行。
OpenAI 為 Codex 在 Windows 上構建安全有效的沙盒,支援 Codex 在 Windows 上運行。沙盒設有受控檔案存取及網絡限制。
Parameter Golf 匯集 1,000+ 名參與者及 2,000+ 份投稿,探索在嚴格限制下進行 AI 輔助機器學習研究。探索範圍包括編碼智能體、量化及新型模型設計。
AutoScout24 Group 透過 AI 驅動工作流程使用 Codex 和 ChatGPT,加快開發週期、提升程式碼品質,並擴大 AI 採用。
OpenAI 透過沙箱、審批、網絡政策及智能體原生遙測,安全運行 Codex。這些措施支援安全且合規地採用編碼智能體。
Simplex 藉助 ChatGPT Enterprise 和 Codex 推動軟件開發,縮短設計、建構及測試所需時間,並擴展 AI 驅動的工作流程。
OpenAI 的 B2B Signals 研究展示前沿企業如何深化 AI 採用、擴大 Codex 驅動的智能體工作流程,並建立持久競爭優勢。
Granite Team(IBM)詳述 Granite 4.1 的 3B、8B 和 30B 模型構建流程,涵蓋預訓練、監督式微調和多階段強化學習。預訓練以約 15T tokens 分五階段進行,並將上下文窗口擴至最高 512K tokens;其後以約 4.1M 經整理樣本作微調,採用 on-policy GRPO 配合 DAPO loss 進行強化學習。
推薦理由:文章梳理 Granite 4.1 從約 15T tokens 預訓練、約 4.1M 樣本微調到多階段強化學習的流程,呈現 dense 模型的訓練設計取捨。
OpenAI 的 GPT models、Codex 與 Managed Agents 現已在 AWS 提供。OpenAI 表示,企業可在 AWS 環境建構安全 AI。
推薦理由:這項 AWS 上線交代了 OpenAI GPT models、Codex 與 Managed Agents 的可用範圍,也説明企業可在 AWS 環境建構安全 AI 的使用場景。
OpenAI 介紹 GPT-5.5,這是一款面向跨工具複雜任務的模型,涵蓋編碼、研究與數據分析。
Hugging Face Blog 提供 Transformers.js 在 Chrome Manifest V3 擴充功能中運行本地 AI 的實作指南。範例將模型初始化、推理和工具執行集中在背景 service worker,側邊欄提供聊天介面,content script 負責網頁內容擷取及元素標記。
推薦理由:文章拆解 Manifest V3 擴充功能內模型推理、對話狀態與頁面操作的分工,並説明背景 service worker 如何協調模型載入、工具執行與介面訊息。
OpenAI 推出 Codex Labs,並與 Accenture、PwC、Infosys 等合作,協助企業在整個軟件開發生命週期部署和擴展 Codex。Codex 的 WAU 達到 4M。
推薦理由:Codex Labs 將企業部署覆蓋至整個軟件開發生命週期,合作夥伴與 4M WAU 分別呈現落地方式和使用規模。
OpenAI 更新 macOS 和 Windows 版 Codex app,加入電腦操作、應用程式內瀏覽、圖像生成、記憶及插件。這些功能旨在加快開發者工作流程。
推薦理由:這組更新同時納入電腦操作、應用程式內瀏覽、圖像生成、記憶及插件,呈現 Codex app 面向開發者工作流程的擴展範圍。
OpenAI 為 ChatGPT Business 和 Enterprise 的 Codex 提供按用量付費定價。該選項讓團隊能以更靈活的方式開始使用並擴大採用。
OpenAI 將收購 Astral,藉此加快 Codex 發展,為下一代 Python 開發者工具提供動力。
推薦理由:這則簡短公告將收購目的連到 Codex 發展與下一代 Python 開發者工具,可據此理解交易所述的產品方向。
OpenAI 發佈 GPT-5.4 mini 和 nano,兩者是 GPT-5.4 的較小、更快速版本。它們針對編碼、工具使用、多模態推理,以及高用量 API 和子智能體工作負載作最佳化。
Mistral AI 發佈 Mistral Small 4,將 Magistral 的推理、Pixtral 的多模態及 Devstral 的智能體編碼能力整合至單一模型。
推薦理由:Mistral Small 4 整合指令、推理、多模態及智能體編碼能力,並列出相較 Mistral Small 3 的吞吐數據,可供比較單一模型承接多類任務時的效率表現。
Mistral AI 開源 Leanstral,一款為 Lean 4 設計、用於程式碼生成與形式化證明的程式碼智能體,採用 6B active parameters。
Codex Security 不依賴傳統 SAST,因此不包含 SAST 報告,而改用 AI 驅動的約束推理與驗證尋找真實漏洞。這種做法可減少誤報。
OpenAI 的 Codex Security 現已進入研究預覽,是一款 AI 應用程式安全智能體。它會分析專案脈絡,以更高信心、較少雜訊偵測、驗證並修補複雜漏洞。
OpenAI 發佈 GPT-5.4,並稱其為面向專業工作的能力最強、效率最高的前沿模型。該模型具備最先進的編碼、電腦操作和工具搜索能力,並有 1M-token 上下文窗口。
OpenAI 與太平洋西北國家實驗室合作推出 DraftNEPABench,評估 AI 編碼智能體加快聯邦許可審批的能力。該 benchmark 顯示,AI 有望將 NEPA 草案撰寫時間最多縮短 15%,並展示現代化基礎設施審查的潛力。
OpenAI 與 Figma 推出新的 Codex 整合,連接程式碼與設計,讓團隊能在實作環節與 Figma 畫布之間切換。這項整合讓團隊可以更快迭代並交付。
OpenAI 不再評測 SWE-bench Verified,因其日益受到污染,且無法準確衡量前沿編碼進展。分析指出,該基準的測試存在缺陷,並有訓練洩漏;OpenAI 建議採用 SWE-bench Pro。
Gradio 6 的 gr.HTML 現支援自訂 HTML 模板、作用域 CSS 與 JavaScript 互動,讓 LLM 可把前端、後端和狀態管理整合到單一 Python 檔案,構建互動式 Web 應用。
Hugging Face 製作 CUDA kernel 技能,Claude 和 Codex 依此為 diffusers 與 transformers 目標產生可運行的 kernel。
推薦理由:文章拆解如何把 GPU 架構知識、PyTorch 整合範式與基準測試流程封裝成技能,讓編碼智能體產出可構建、可測試的 CUDA kernel 專案。
OpenAI 發佈 GPT-5.3-Codex-Spark,並稱其為首個即時編碼模型,生成速度快 15x,具備 128k 上下文窗口。目前以研究預覽形式向 ChatGPT Pro 用户提供。
推薦理由:公告列出生成速度、上下文窗口及研究預覽的適用對象,讓讀者可同時瞭解 GPT-5.3-Codex-Spark 的性能宣稱與目前開放範圍。
OpenAI 技術人員 Ryan Lopopolo 探討 Harness 工程,聚焦在智能體優先的世界中如何運用 Codex。
GPT-5.3-Codex 系統卡將該模型描述為迄今能力最強的智能體編碼模型。它結合 GPT-5.2-Codex 的前沿編碼表現,以及 GPT-5.2 的推理和專業知識能力。