OpenAI 研究:對齊中訓練能泛化多遠?
OpenAI 研究人員測試對齊中訓練在類似 o4-mini 的模型上能否泛化;模型經過推理後訓練後,這種訓練效果未能穩定延伸至較貼近現實的聊天及智能體評測。他們分別以 230k 份文件(約 340M tokens)進行對齊或失準中訓練,並與不加額外中訓練的基線比較;接近訓練分佈的問答評測呈現預期排序。聊天評測中,兩種中訓練結果大多相近;智能體評測未能明確區分三組模型,整體分數沒有顯著差異。
OpenAI 研究人員測試對齊中訓練在類似 o4-mini 的模型上能否泛化;模型經過推理後訓練後,這種訓練效果未能穩定延伸至較貼近現實的聊天及智能體評測。他們分別以 230k 份文件(約 340M tokens)進行對齊或失準中訓練,並與不加額外中訓練的基線比較;接近訓練分佈的問答評測呈現預期排序。聊天評測中,兩種中訓練結果大多相近;智能體評測未能明確區分三組模型,整體分數沒有顯著差異。
OpenAI 以 Model Spec 作為公開的模型行為框架,在 AI 系統發展之際平衡安全、使用者自由與問責。這套框架呈現 OpenAI 對模型行為的處理方式。
OpenAI 推出 Safety Bug Bounty 計劃,旨在識別 AI 濫用與安全風險。計劃涵蓋智能體漏洞、提示詞注入及資料外洩。
OpenAI 發佈提示詞式青少年安全政策,供使用 gpt-oss-safeguard 的開發者協助管理 AI 系統中的年齡相關風險。
ChatGPT 推出由 Agentic Commerce Protocol 驅動的更豐富、具視覺沉浸感購物體驗。該體驗支援商品探索、並排比較及商户整合。
OpenAI Foundation 宣佈計劃至少投資 $1 billion。資金將用於疾病治療、經濟機會、AI 韌性及社區項目。
OpenAI 開發 Sora 2 和 Sora app 時,以安全為根基,應對最先進影片模型及全新社交創作平台帶來的新安全挑戰。其安全方案以具體防護措施為核心。
OpenAI 將收購 Astral,藉此加快 Codex 發展,為下一代 Python 開發者工具提供動力。
推薦理由:這則簡短公告將收購目的連到 Codex 發展與下一代 Python 開發者工具,可據此理解交易所述的產品方向。
OpenAI 發佈 GPT-5.4 mini 和 nano,兩者是 GPT-5.4 的較小、更快速版本。它們針對編碼、工具使用、多模態推理,以及高用量 API 和子智能體工作負載作最佳化。
OpenAI Japan 公佈 Japan Teen Safety Blueprint,為使用生成式 AI 的青少年引入更完善的年齡保護、家長控制及身心健康保障措施。
美國人每天向 ChatGPT 發送近 300 萬則詢問薪酬與收入的訊息,這些查詢有助縮小薪資資訊差距。
Codex Security 不依賴傳統 SAST,因此不包含 SAST 報告,而改用 AI 驅動的約束推理與驗證尋找真實漏洞。這種做法可減少誤報。
ChatGPT 在智能體工作流程中,透過限制高風險操作及保護敏感資料,防範提示詞注入與社交工程攻擊。這套防護設計著重約束風險操作,並保障工作流程中的敏感資料。
Wayfair 使用 OpenAI 模型改善電商支援及商品目錄準確度,並提升支援速度。其應用包括自動分流支援工單,以及大規模改善數以百萬計商品屬性。
IH-Challenge 訓練模型優先遵循可信指令,改善前沿大語言模型的指令層級。此訓練亦提升模型的安全可引導性,以及抵禦提示詞注入攻擊的能力。
ChatGPT 推出數學與科學的互動式視覺解釋,讓學生可即時探索公式、變數和概念。
推薦理由:這項更新交代了互動式視覺解釋涵蓋公式、變數與概念探索,呈現 ChatGPT 用於數學和科學學習的具體形式。
OpenAI 正在收購 AI 安全平台 Promptfoo,該平台協助企業在開發期間識別並修復 AI 系統中的漏洞。
OpenAI 的 Codex Security 現已進入研究預覽,是一款 AI 應用程式安全智能體。它會分析專案脈絡,以更高信心、較少雜訊偵測、驗證並修補複雜漏洞。
Balyasny Asset Management 結合嚴謹的模型評估、全面運用 OpenAI 平台及智能體工作流程,重塑投資研究。
OpenAI 介紹 CoT-Control,並發現推理模型難以控制自身思維鏈,進一步凸顯可監控性作為 AI 安全保障的作用。
OpenAI 發佈 GPT-5.4,並稱其為面向專業工作的能力最強、效率最高的前沿模型。該模型具備最先進的編碼、電腦操作和工具搜索能力,並有 1M-token 上下文窗口。
OpenAI 分享新工具、認證及評估資源,協助學校和大學縮小 AI 能力差距並拓展機遇。這些資源旨在確保教育界使用 AI 能帶來機會。
OpenAI 推出由 GPT-5.4 驅動的 ChatGPT for Excel,並新增金融應用程式整合,以加快受監管環境中的建模、研究與分析。
德甲球會 VfL Wolfsburg 正把 ChatGPT 發展為全球會的共同能力。球會以人為本而非着眼試點,藉此擴展效率、創意與知識,同時保留其足球身份。
OpenAI 推出 Adoption 新聞頻道,內容聚焦把 AI 進展轉化為商業優勢的實用見解與框架。
新預印本將 single-minus 振幅延伸至引力子,GPT-5.2 Pro 協助推導及驗證量子引力中的非零引力子樹振幅。
OpenAI 推出 Learning Outcomes Measurement Suite,以評估 AI 對學生學習的影響。該套件可跨不同教育環境,隨時間衡量這種影響。
OpenAI 説明與 Department of War 的合約安排,涵蓋安全紅線、法律保障,以及 AI 系統在機密環境中的部署方式。
推薦理由:內容從安全紅線、法律保障和機密環境部署三方面呈現合約安排,提供理解政府機密場景中 AI 系統部署的具體切入點。
OpenAI 宣佈獲得 $110B 新投資,投前估值為 $730B。SoftBank 和 NVIDIA 各投入 $30B,Amazon 投入 $50B。
推薦理由:公告把融資總額、投前估值與三家出資方的金額拆分列明,讀者可同時掌握本輪資金規模及各方投入比例。
OpenAI 與 Amazon 宣佈戰略合作,將 OpenAI 的 Frontier 平台帶至 AWS。合作亦將擴展 AI 基礎設施、客製模型及企業 AI 智能體。
推薦理由:合作將 Frontier 平台帶至 AWS,並涉及基礎設施、客製模型及企業智能體,可由此瞭解雙方合作涵蓋的企業 AI 範圍。
OpenAI 在 Amazon Bedrock 推出面向 AI 智能體的有狀態執行環境 Stateful Runtime for Agents。該環境為由 OpenAI 驅動的多步驟 AI 工作流程提供持久化編排、記憶與安全執行。
OpenAI 與 Microsoft 聯合聲明表示,雙方將繼續在研究、工程及產品開發方面緊密合作。這項合作延續多年來的深入協作與共同成果。
OpenAI 與太平洋西北國家實驗室合作推出 DraftNEPABench,評估 AI 編碼智能體加快聯邦許可審批的能力。該 benchmark 顯示,AI 有望將 NEPA 草案撰寫時間最多縮短 15%,並展示現代化基礎設施審查的潛力。
OpenAI 與 Figma 推出新的 Codex 整合,連接程式碼與設計,讓團隊能在實作環節與 Figma 畫布之間切換。這項整合讓團隊可以更快迭代並交付。
OpenAI 最新威脅報告探討惡意行為者如何將 AI 模型與網站及社交平台結合使用。報告亦分析這類活動對偵測與防禦工作的意義。
OpenAI 的 Codex 提示詞指南介紹如何透過 API 使用 gpt-5.3-codex,並配置編碼智能體的提示詞與工具。指南建議一般互動式編碼採用 medium reasoning effort,較難任務可選 high 或 xhigh,並移除要求模型預先提供計劃、前言或執行期間狀態更新的提示。
OpenAI 任命 Arvind KC 出任首席人事官,協助公司擴大規模並強化企業文化。其職責亦包括帶領 AI 時代工作方式的演變。
新論文評估 14 個模型,發現近 18 個月模型能力提升明顯,AI 智能體可靠性僅小幅改善。研究把可靠性拆分為一致性、穩健性、可預測性和安全性四個維度,以 12 項指標測試 GAIA 與 TauBench;可預測性是整體最弱的一環。作者建議在準確率之外同步報告可靠性各維度表現,並計劃推出 AI agent reliability index。
OpenAI 不再評測 SWE-bench Verified,因其日益受到污染,且無法準確衡量前沿編碼進展。分析指出,該基準的測試存在缺陷,並有訓練洩漏;OpenAI 建議採用 SWE-bench Pro。
OpenAI 宣佈 Frontier Alliance Partners,協助企業將 AI 試點項目轉入生產環境,並以安全、可擴展的方式部署智能體。