OpenAI 的業務模式隨智能價值擴展
OpenAI 的業務模式隨智能價值擴展,涵蓋訂閲、API、廣告、商務及算力,並由 ChatGPT 採用深化所帶動。
OpenAI 的業務模式隨智能價值擴展,涵蓋訂閲、API、廣告、商務及算力,並由 ChatGPT 採用深化所帶動。
Google DeepMind 推出 D4RT,這是一個統一的 AI 模型,可重建並追蹤跨越空間與時間的 4D 場景。測試中,D4RT 比此前方法快 18x 至 300x;在單顆 TPU 上,約 5 秒即可處理 1 分鐘影片,而舊方法最多需 10 分鐘。其查詢式 Transformer 架構支援點追蹤、點雲重建及相機姿態估計,應用方向包括機械人、擴增實境與世界模型。
OpenAI 宣佈 ChatGPT Go 現已全球開放,提供 GPT-5.2 Instant 的擴大使用權限、更高使用上限及更長記憶。OpenAI 表示,ChatGPT Go 令全球使用進階 AI 更可負擔。
推薦理由:全球開放與 GPT-5.2 Instant 使用權限、使用上限和記憶長度的變化,呈現 ChatGPT Go 擴大可用性的具體內容。
OpenAI 計劃在美國為 ChatGPT 免費版及 Go 版測試廣告,以擴大全球以可負擔方式使用 AI 的機會。OpenAI 表示,這項做法將兼顧私隱、信任及回答品質。
推薦理由:這項計劃把 ChatGPT 廣告測試與擴大平價 AI 使用機會相連,並交代 OpenAI 對私隱、信任和回答品質的承諾。
OpenAI 投資 Merge Labs,以支持連接生物智能與人工智能的新型腦機介面,目標是最大化人類能力、能動性與體驗。
OpenAI 推出新的 RFP,旨在加快美國本土製造業發展,強化美國 AI 供應鏈。計劃亦着眼於創造就業職位及擴大 AI 基礎設施。
OpenAI 與 Cerebras 合作增加 750MW 高速 AI 算力,以降低推理延遲,並讓 ChatGPT 在即時 AI 工作負載下更快。
推薦理由:這項合作把 750MW 高速算力與降低推理延遲、提升 ChatGPT 即時 AI 工作負載速度連結起來,交代新增算力的服務用途。
Google 發佈開放醫療多模態模型 MedGemma 1.5 4B,新增 CT、MRI、病理全切片及胸部 X 光時間序列等醫療影像處理能力。其基準結果較 MedGemma 1 4B 提升,例如 CT 疾病分類準確率為 61%(58%),MRI 為 65%(51%),醫療文本 EHRQA 為 90%(68%)。
推薦理由:MedGemma 1.5 4B 在多項醫療影像與文本基準上較前代提升,文中列出的具體分數可用來比較不同任務的改進幅度。
Google DeepMind 更新 Veo 3.1 Ingredients to Video,提升參考圖像生成影片的一致性與表現,並加入原生 9:16 直向輸出及 1080p、4K 升頻。
推薦理由:更新同時處理參考圖像影片中的角色、背景與物件一致性,並加入原生直向及高解像度輸出,可看出 Veo 3.1 如何覆蓋短片創作與專業製作需求。
Zenken 在全公司部署 ChatGPT Enterprise,提升銷售表現、縮短準備時間,並提高提案成功率。AI 支援的工作流程協助精簡的銷售團隊提供更個人化且有效的客户互動。
Google Research 在 Science Advances 發表 NeuralGCM 降水研究,報告模型在 280 km 解析度下改善最長 15 天的降水預報及多年氣候模擬。
推薦理由:研究展示以 NASA 衞星降水觀測直接訓練 NeuralGCM 機器學習部分的做法,並呈現極端降水與日變化模擬的改善。
Berkeley AI Research 提出一套以互信息直接評估及優化成像系統的框架,並在 NeurIPS 2025 論文中驗證其對四類成像應用的預測能力。方法利用含噪測量與已知噪聲模型估算互信息,測試涵蓋彩色攝影、射電天文、無透鏡成像和顯微鏡。IDEAL 僅優化成像系統的編碼器,不需反向傳播整個解碼器;在色彩濾光片設計中,結果匹配端到端優化,並減少記憶體及計算需求。
OpenAI 與 SoftBank Group 聯同 SB Energy 合作開發多吉瓦級 AI 數據中心園區。項目包括一座位於德州、支援 Stargate 計劃的 1.2 GW 設施。
推薦理由:合作涵蓋多吉瓦級 AI 數據中心園區,並列出支援 Stargate 計劃的德州 1.2 GW 設施,可瞭解項目規模及合作的具體落點。
Datadog 使用 Codex 進行系統層級程式碼審查。正文只呈現 OpenAI 與 Datadog 的品牌圖像,沒有補充審查流程或成效。
OpenAI for Healthcare 提供支援 HIPAA 合規的安全企業級 AI,可減輕行政負擔並支援臨牀工作流程。
Netomi 使用 GPT-4.1 和 GPT-5.2 擴展企業 AI 智能體系統,結合並發處理、治理與多步推理,以建立可靠的生產工作流程。
Tolan 以 GPT-5.1 打造語音優先的 AI 伴侶,結合低延遲回應、即時情境重建與記憶驅動的人格,帶來自然對話體驗。
OpenAI 推出 ChatGPT Health,這是一項專屬體驗,可安全連接健康數據和應用程式。它設有私隱保護,設計參考醫師意見。
NVIDIA 發佈 Cosmos Reason 2,稱其在 Physical AI Bench 和 Physical Reasoning 榜單位列視覺理解開放模型第一。
Falcon-H1-Arabic 發佈 3B、7B、34B 三種阿拉伯語模型,採用 Mamba 與 Transformer 混合架構。3B 的上下文窗口為 128K tokens,7B 和 34B 均為 256K tokens。
OpenAI Grove Cohort 2 現已開放申請,這是一項為期 5 週、面向從尚未有構想到已有產品等不同階段個人的創辦人計劃。參與者可獲 $50K API 額度、提前使用 AI 工具,以及 OpenAI 團隊提供的實作指導。
ServiceNow AI 發佈 AprielGuard,一款 8B 參數的安全防護模型,可分類 16 類安全風險並檢測多種對抗攻擊。模型支援單獨提示詞、多輪對話及包含工具呼叫、推理軌跡和記憶的智能體工作流,並提供可輸出結構化解釋的推理模式和僅分類的快速模式。
OpenAI 正利用經強化學習訓練的自動化紅隊測試,持續強化 ChatGPT Atlas 防範提示詞注入攻擊。這套主動的「發現並修補」循環有助及早找出新型漏洞利用方式,並隨着 AI 越趨智能體化而加固瀏覽器智能體的防禦。
全球逾 100 萬名客户正使用 OpenAI,藉此賦能團隊並開拓新機會。PayPal、Virgin Atlantic、BBVA、Cisco、Moderna 和 Canva 等公司正以 AI 改變工作方式。
Google Research 回顧 2025 年研究成果,涵蓋生成模型、生成式 UI、量子計算、AI 科學工具及氣候、醫療與教育應用。Gemini 3 引入生成式 UI,可按提示詞生成互動介面;Gemma 擴展至 140 多種語言。效能研究顯示,使用 Learn Your Way 的學生在保留測試中的得分高 11 個百分點。
OpenAI 推出一套評估鏈式推理可監測性的框架與評測套件,涵蓋 24 個環境中的 13 項評測。研究結果顯示,監測模型內部推理比只監測輸出有效得多,並為 AI 系統日益強大時的可擴展控制提供一條有前景的路徑。
OpenAI 與美國能源部簽署諒解備忘錄,深化 AI 與先進運算合作,以支持科學發現。協議以正在進行的國家實驗室合作為基礎,並建立在能源部體系內運用 AI 開展高影響力研究的框架。
OpenAI 更新 Model Spec,新增 Under-18 Principles,界定 ChatGPT 如何以符合年齡、並以發展科學為基礎的指引支援青少年。更新亦加強防護措施,釐清模型在較高風險情境下的預期行為,並延續 OpenAI 在 ChatGPT 青少年安全方面的工作。
OpenAI 分享新的 AI 素養資源,協助青少年與家長審慎、安全且有信心地使用 ChatGPT。指南提供經專家審核的負責任使用、批判思考與健康界線建議,並説明如何支持青少年面對情緒或敏感話題。
Transformers v5 將分詞器架構與訓練所得的詞彙、合併規則分離,並在類別中明確呈現正規化器等組件。相較 v4 每個模型各有 slow/fast 兩套實作,v5 改為每個模型一個檔案,預設採用 Rust-based TokenizersBackend;分詞器類別亦可直接實例化並用自有語料訓練。
推薦理由:文章對照 v4 與 v5,説明分離分詞器架構和訓練詞彙後,如何更直接檢查組件,並沿用模型架構訓練自訂分詞器。
OpenAI 表示,GPT-5.2-Codex 是其最先進的編碼模型,具備長程推理、大規模程式碼轉換及增強的網絡安全能力。
Mistral AI 發佈 Mistral OCR 3,在表單、掃描文件、複雜表格及手寫內容的內部測試中,較 Mistral OCR 2 整體勝率為 74%。模型可經 API(mistral-ocr-2512)或 Mistral AI Studio 的 Document AI Playground 使用,定價為每 1,000 頁 $2,Batch API 折扣後為 $1。
Google DeepMind 發佈 Gemini 3 Flash,結合 Gemini 3 Pro 級推理與 Flash 級延遲、效率和成本,並按 Artificial Analysis 基準測試較 Gemini 2.5 Pro 快 3x。
推薦理由:文章以推理、多模態與編碼基準成績,連同速度、token 用量及 API 定價,呈現 Gemini 3 Flash 的效能與成本定位。
OpenAI 推出與 American Journalism Project 及 The Lenfest Institute 共同建立的 OpenAI Academy for News Organizations,協助新聞編輯室有效運用 AI。學院提供培訓、實用案例及負責任使用指引,支援記者、編輯和出版商在報道及營運中採用 AI。
OpenAI 以數據呈現企業 AI 採用現況,展示組織如何從實驗走向實際生產力提升與新能力拓展。
OpenAI 現已開放開發者提交應用,供 ChatGPT 審核及發布;獲批應用會出現在新的產品內目錄,方便用户發現。更新的工具、指南和 Apps SDK 可協助開發者構建原生於聊天的體驗,把現實世界操作帶入 ChatGPT。
推薦理由:這項更新交代了 ChatGPT 應用提交審核、獲批發布及目錄展示的流程,並列出供開發者使用的工具、指南和 Apps SDK。
OpenAI 推出 FrontierScience 基準測試,評估 AI 在物理、化學和生物學領域的推理能力,以衡量 AI 邁向真實科學研究的進展。
OpenAI 推出真實場景評估框架,衡量 AI 在濕實驗室加速生物研究的能力。研究使用 GPT-5 優化分子克隆方案,並探討 AI 輔助實驗的潛力與風險。
OpenAI 推出更快的 ChatGPT Images 體驗,並在 API 中提供 GPT-Image-1.5。材料亦提及 ChatGPT Images 2.5,但未提供更多細節。
推薦理由:更新同時涵蓋 ChatGPT Images 體驗提速與 GPT-Image-1.5 在 API 提供,呈現這次發佈涉及的兩部分變化。
Google DeepMind 更新 Gemini 2.5 Flash Native Audio,提升其處理複雜工作流、遵循指令及進行多輪語音對話的能力。它在 ComplexFuncBench Audio 得分為 71.5%,開發者指令遵循率由 84% 升至 90%;目前已在 Vertex AI 正式提供,並以預覽版開放 Gemini API。
推薦理由:更新同時改善即時語音 Agent 的函數調用、指令遵循與多輪對話,並以 ComplexFuncBench Audio 的 71.5% 得分呈現多步函數調用表現。