Cisco 與 OpenAI 藉助 Codex 重新定義企業工程
Cisco 與 OpenAI 藉助 Codex 重塑企業工程,協助 Cisco 擴展 AI 原生開發、加快 AI Defense 工作,並自動化缺陷修復。
Cisco 與 OpenAI 藉助 Codex 重塑企業工程,協助 Cisco 擴展 AI 原生開發、加快 AI Defense 工作,並自動化缺陷修復。
OpenAI、Thrive 與 Crete 使用 Codex 構建自我改進的税務智能體,實現申報自動化、提升準確度並加快工作流程。
OpenAI 將透過可靠資訊、網絡防禦與 AI 透明度等措施,支援 2026 年選舉。其支援範圍亦包括濫用防護及偏見監察。
Hugging Face 梳理 AI 智能體常見術語,解釋 Model、Scaffolding、Harness、Agent 等概念及其區別。文中將 Harness 定義為調用模型、處理工具調用及決定何時停止的執行層,Scaffolding 則涵蓋系統提示詞、工具描述、回應解析和上下文管理等行為定義層。
推薦理由:文章以模型、Scaffolding、Harness 與 Agent 的分工建立實用心智模型,並把這套脈絡延伸至訓練術語,便於理解智能體系統的組成與相關討論。
OpenAI 與 Grupo Folha、Grupo UOL 宣佈建立戰略內容合作,將可信的巴西新聞內容帶入 ChatGPT。合作將擴大新聞資訊的可及性,並提供來源歸屬與透明度。
Mistral AI 宣佈已達成收購 Physics AI 公司 Emmi AI 的最終協議,以擴充工業工程領域的模型與專業能力。Emmi AI 的聯合創辦人及 30 多名研究人員和工程師將於 5 月加入 Mistral AI 的 Science 和 Applied AI 團隊。Mistral AI 表示,Emmi AI 的模型將補充其自有模型,並支持打造工程師智能體、推進即時模擬及數碼孿生。
推薦理由:收購將 Emmi AI 的 Physics AI 專長、工程模型及逾 30 名研究人員與工程師納入 Mistral AI,呈現其拓展工業工程能力的具體路徑。
Mistral 推出 Mistral Medium 3.5 公開預覽,並以此支援 Mistral Vibe 雲端遠端編碼代理及 Le Chat 的 Work mode。
推薦理由:材料展示模型、雲端編碼代理與 Le Chat 多步驟工具流程的連接方式,能看出長程任務如何落入具體產品工作流。
Mistral AI 在 Studio 推出 Connectors,內置連接器及自訂 MCP 現可透過 API/SDK 用於模型與 Agent 調用。開發者可直接調用工具、程式化建立和管理連接器,並在工具執行前加入人工確認流程。Connectors 目前於 Studio 開放 Public Preview,集中註冊的連接器亦可供 LeChat 和 AI Studio 使用,Vibe 即將推出。
推薦理由:連接器把 MCP 整合封裝成可跨對話、Agent 與工作流重用的項目,並以直接調用和人工確認保留工具執行控制。
Virgin Atlantic 使用 Codex,在固定的假日旅遊期限前交付改版流動應用程式。成果包括近乎全面的單元測試覆蓋率,以及零宗 P1 缺陷。
OpenAI 獲 Gartner 評為 2026 年企業級 AI 編碼智能體魔力象限的領導者。Codex 因創新及企業規模部署獲得認可。
AdventHealth 正使用 ChatGPT for Healthcare 精簡工作流程、減輕行政負擔,讓醫護人員把更多時間投入患者照護。
Ramp 工程師使用 Codex 搭配 GPT-5.5 審查程式碼並交付改進,讓取得實質回饋的時間由數小時縮短至數分鐘。
OpenAI 推進 Education for Countries,透過新合作夥伴關係、教師培訓及工具,擴大學校採用 AI。相關工具旨在改善全球學習成效。
OpenAI 的一個模型解決了有 80 年歷史的單位距離問題,推翻離散幾何中的一項重要猜想。這項成果標誌著 AI 驅動數學的一個里程碑。
推薦理由:這項成果為 AI 驅動數學提供一個具體案例,呈現模型解決離散幾何 80 年單位距離問題並推翻重要猜想的結果。
OpenAI 啟動 OpenAI for Singapore 多年期 AI 合作計劃,旨在擴大 AI 部署、培育本地人才,並支援企業及公共服務採用 AI。
Google Research 開放 ERA 科學研究工具,並開始逐步開放由 ERA 與 AlphaEvolve 構建的 Computational Discovery。
推薦理由:文章把 ERA 的樹狀搜尋方法與多學科基準和實際科學問題並置,呈現其從程式碼優化延伸至預測研究的應用範圍。
OpenAI 透過 Content Credentials、SynthID 及驗證工具推進 AI 內容溯源,協助人們識別並信任 AI 生成媒體。這項工作旨在推動更安全、透明的 AI 生態系統。
Hugging Face 發佈六款基於 Ettin ModernBERT encoder 的 Sentence Transformers CrossEncoder reranker,參數規模由 17.6M 至 1.00B,並公開訓練數據及完整訓練方案。
推薦理由:文章以 MTEB(eng, v2) Retrieval、NanoBEIR 及多種硬件吞吐測試比較六種尺寸,呈現 Ettin Reranker 在排序品質與速度間的取捨。
PaddleOCR 3.5 為支援的 OCR 與文件解析模型加入 Transformers 推理後端,開發者可透過 `engine` 參數選擇。`engine_config` 可設定 dtype、裝置配置及 attention implementation;若優先考慮 OCR 或文件解析吞吐量,文章通常建議使用預設的 paddle_static 後端。
OpenAI 與 Dell 合作,將 Codex 帶進混合式及本地部署企業環境。合作協助企業跨數據與工作流程安全部署 AI 編碼智能體。
Google DeepMind 為 Project Genie 加入 Street View 地點錨定能力,並開始向全球符合資格的 Google AI Ultra $200 訂閲者逐步開放(18+)。
推薦理由:Project Genie 把美國 Street View 地點作為生成世界的起始位置,並可套用不同風格,具體呈現真實地理影像如何用於構建虛擬環境。
Google DeepMind 推出 Gemini Omni 系列首個模型 Gemini Omni Flash,可結合圖像、影片、文字及語音參考生成影片,並支援透過對話編輯。
推薦理由:材料把 Gemini Omni Flash 的多模態輸入、對話式影片編輯和分階段上線平台放在一起,便於理解新模型如何連接生成能力與實際使用入口。
Google DeepMind 推出 Gemini for Science,涵蓋 Google Labs 三項科學研究實驗及 Google Antigravity 的 Science Skills。
推薦理由:三項實驗工具分別對應假設生成、計算探索與文獻整理,呈現 Gemini for Science 將 AI 智能體引入科研流程不同環節的設計。
Google 擴展內容來源驗證工具至 Search、Gemini、Chrome、Pixel 和 Cloud,並在 Google Cloud 推出 AI Content Detection API。
推薦理由:內容驗證由面向一般使用者的 Gemini、Search、Chrome 延伸至 Cloud API,後者可識別 Google 及其他熱門模型生成內容,協助企業評估和管理自有平台上的媒體。
Google DeepMind宣佈在新加坡推出多項AI合作計劃,並參與Google與新加坡政府的全國AI夥伴關係。計劃涵蓋醫療與生命科學、科研、教育及可持續發展,並推進多模態與多語言安全基準研究;Gemini for Education已提供予小學至初級學院的所有教育工作者。
愛丁堡大學的 Filippo Menolascina 團隊使用 Co-Scientist 梳理 MASH 文獻,提出後經實驗驗證的肝病機製假説。針對近期獲批、用於 MASH 特定階段的 resmetirom 僅對少部分合資格患者有效的問題,該假説將 NLRP3 炎症小體指為連接疾病中炎症與代謝的分子橋樑。
Stanford University School of Medicine 的 Gary Peltz 團隊測試 Co-Scientist 提出的 3 種肝纖維化候選藥物,當中 2 種阻止纖維化並促進肝細胞再生。
推薦理由:研究在同一活體人類肝細胞平台比較 Co-Scientist 與研究者挑選的藥物,呈現系統從少量相關文獻線索中找到候選藥物的案例。
OpenAI 與馬耳他合作,向全體公民提供 ChatGPT Plus 和培訓,以擴大 AI 使用機會。培訓旨在協助公民建立實用 AI 技能,並負責任地使用 AI。
Google DeepMind 發佈 Gemini 3.5 模型系列,首款 Gemini 3.5 Flash 即日起透過 Gemini app 和 Google Search 的 AI Mode 向全球用户開放。
推薦理由:Gemini 3.5 Flash 列出代理任務、編碼及多模態基準成績,並比較每秒輸出 tokens 的速度,讓性能主張有多項指標可供對照。
ChatGPT 推出個人理財新體驗,讓用户連接賬户、追蹤支出與投資。它亦可用於管理訂閲、制定預算及規劃財務目標。
ChatGPT Work 的實用營運工作流程涵蓋倡議簡報、策略更新、決策資料包及進度匯報。這些流程提供相關工作的實用操作方式。
Databricks 將 GPT-5.5 用於企業智能體工作流程。GPT-5.5 此前在 OfficeQA Pro benchmark 上創下新的最佳水平。
Sea Limited 正在各工程團隊部署 Codex,以加快亞洲的 AI 原生軟件開發。其首席產品官闡述此舉背後的原因,並談及 Codex 與智能體軟件開發的未來。
IBM Granite 發佈兩款採 Apache 2.0 授權的多語嵌入模型:97M 參數的 granite-embedding-97m-multilingual-r2 和 311M 參數的 granite-embedding-311m-multilingual-r2。
推薦理由:文章提供 97M 與 311M 版本在多語檢索、長文及程式碼基準的比較,並交代 Matryoshka 維度選項對儲存與部署取捨的影響。
OpenAI 讓用户透過 ChatGPT 手機應用程式跨裝置及遠端環境使用 Codex。用户可即時監看、調整及核准編碼任務。
推薦理由:這項更新把 Codex 編碼任務的監看、調整與核准延伸至 ChatGPT 手機應用程式,讓相關操作可跨裝置及遠端環境進行。
ChatGPT 的新安全更新提升了其在敏感對話中的語境辨識能力。更新有助於隨時間偵測風險,並作出更安全的回應。
OpenAI 為 Codex 在 Windows 上構建安全有效的沙盒,支援 Codex 在 Windows 上運行。沙盒設有受控檔案存取及網絡限制。
OpenAI 説明其對 TanStack「Mini Shai-Hulud」npm 供應鏈攻擊的應對,並概述為保護系統及簽署憑證所採取的措施。該文亦解釋 macOS 用户必須在 2026 年 6 月 12 日前更新 OpenAI 應用程式的原因。
ChatGPT Work 的實用財務工作流程涵蓋報告、差異分析、預測、月度檢討,以及可供決策的財務交付成果。
Google DeepMind 公佈以 Gemini 構建的 Co-Scientist 多智能體科研系統,將逐步向研究人員開放。Hypothesis Generation 實驗工具將於未來數週開始推出,研究人員可在 labs.google/science 登記意向;系統以專職智能體生成、辯論和演化假設,再用 Elo-based tournament 排序並交叉核查文獻與數據。
推薦理由:Co-Scientist 以多智能體迭代生成、辯論和篩選科研假設,肝纖維化案例亦列出一項候選藥物在實驗室阻斷 91% 疤痕相關反應的結果。