跳到正文
  1. OpenAI News62

    OpenAI 公開內部前沿模型產生的數學成果

    OpenAI 公開由其內部前沿模型產生的一系列數學成果,並在 GitHub 儲存庫提供論文修訂與引用的相關流程,以及多項 Lean 證明形式化。儲存庫亦披露 10 份模型推理摘要、以 ChatGPT Pro 使用量估算的計算量,以及嘗試題目數統計;平均每項成果所用計算量約相當於 ChatGPT Pro 思考 3 小時。

    推薦理由:OpenAI 同時公開 Lean 證明形式化、10 份推理摘要及計算量與嘗試題目統計,讀者可由此查看數學成果以外的部分研究過程資訊。

  1. 英國 AI Security Institute:Blog76

    英國 AI Security Institute 評估 OpenAI GPT-5.5 的網絡安全能力

    英國 AI Security Institute 評估中,GPT-5.5 的 Expert 級進階任務平均通過率為 71.4%,高於 Mythos Preview 的 68.6%。

    推薦理由:報告分別測試進階網絡任務、企業攻擊鏈及工控模擬,並交代結果與測試限制,呈現 GPT-5.5 網絡安全能力的不同面向。

  2. Cerebras:Blog76

    OpenAI 與 Cerebras 簽訂多年協議,部署總容量達 750 megawatts 的晶圓級系統

    OpenAI 與 Cerebras 簽訂多年協議,將分階段部署 750 megawatts 的 Cerebras 晶圓級系統,為 OpenAI 客戶提供服務。部署將於 2026 年開始;Cerebras 稱這將成為全球最大高速 AI 推理部署。Cerebras 表示,其系統上的大語言模型在編碼智能體或語音聊天場景中,回應速度較基於 GPU 的系統快達 15×。

    推薦理由:文章列出 750 megawatts 的部署規模,並引述 Cerebras 稱其推理回應較 GPU 系統快達 15×,呈現合作的規模與方案定位。

  1. LlamaIndex:產品、工程與評測79

    LlamaIndex 在 OpenAI Developer Day 當日加入新模型與功能支援

    LlamaIndex 在 OpenAI Developer Day 當日為其程式庫加入對兩款新模型及多項 OpenAI 功能的支援。

    推薦理由:文章列出 LlamaIndex 對新模型、Azure endpoints、嵌入向量抽象層及函數調用的支援,並附模型調用程式例子,呈現這次更新涵蓋的整合範圍。

  2. OpenAI Developers:Blog76

    OpenAI Realtime API 開發者筆記:GA 後語音對語音更新要點

    OpenAI 整理 Realtime API 與 gpt-realtime 語音對語音模型進入 GA 後的介面變更、新功能及整合注意事項。文章建議客户遷移至 GA 介面,並説明 beta 與 GA 在功能支援、temperature 和非同步函式呼叫上的差異。

    推薦理由:文章對照 beta 與 GA 的功能支援差異,並説明介面遷移、temperature 設定及長對話截斷的處理方式,方便開發者按整合環節核對需要調整的設定。

  3. OpenAI Developers:Blog76

    OpenAI 分享以 Skills、託管 shell 與服務端 compaction 建構長時間運行智能體的實作技巧

    OpenAI 分享以 Skills、託管 shell 和服務端 compaction 構建長時間運行智能體的實作模式,涵蓋技能路由、容器復用與網絡配置。Glean 面向 Salesforce 的 skill 將評測準確率由 73% 提升至 85%,並令 time-to-first-token 縮短 18.1%。

    推薦理由:文章將 Skills、shell 與服務端 compaction 的分工整理成長流程建構方法,並涵蓋技能路由、產物交接及網絡隔離等可複用設計。

  4. Artificial Analysis 完整文章76

    GPT-6 Sol 和 Luna 價格約減半,推進成本效率前沿

    Artificial Analysis 的評測指出,GPT-6 Sol 和 Luna 定價約為 GPT-5.6 的一半,Intelligence Index 分數大致持平。

    推薦理由:文章並列價格、單項任務成本與多項基準結果,呈現降本幅度與不同能力變化並不一致,並指出 GDPval-AA v2.1 的回退與交付內容縮短相關。

  5. Artificial Analysis 完整文章77

    GPT-6.1 Sol 取代僅發佈 7 天的 GPT-6 Sol,Intelligence Index 接近 GPT-6 Astra

    GPT-6.1 Sol 取代僅發佈 7 天的 GPT-6 Sol,其 Intelligence Index 比 GPT-6 Astra 低 1 分,最高 effort 下的每項 Intelligence Index 任務成本不到後者四分之一。

    推薦理由:這篇評測以同一框架對照 GPT-6.1 Sol、GPT-6 Sol 和 GPT-6 Astra 的 Intelligence Index 分數與單項任務成本,為比較新版本接近 Astra 分數時的成本取捨提供具體依據。

  1. AWS Machine Learning Blog67

    GPT-6.1 Sol 在 Amazon Bedrock 正式開放使用,面向智能體編碼與專業工作負載

    GPT-6.1 Sol 已在 Amazon Bedrock 正式開放使用,面向智能體編碼、電腦操作及專業工作負載。OpenAI 表示,GPT-6.1 Sol 在 DeepSWE v1.1 上匹配 GPT-6 Astra,單項任務成本約為 GPT-6 Astra 的五分之一;其分數亦比 GPT-6 Sol 的最佳結果高 6.4 個百分點,且所用推理力度較低。

    推薦理由:文章列出 GPT-6.1 Sol 在 DeepSWE v1.1 上與 GPT-6 Astra 的任務成本對照,並比較其對 GPT-6 Sol 的分數提升。

  1. Simon Willison84

    OpenAI DevDay 2026 即時紀錄:發佈 GPT-6.1 Sol、Dots 等產品與功能

    OpenAI 在 DevDay 2026 發佈 GPT-6.1 Sol、Dots 智能體及多項開發者工具與功能。GPT-6.1 Sol 主打接近 Astra 的智能水平,價格為 Astra 的五分之一;Ultrafast 最高達 300 tokens/second,速度快 8x,先支援 Astra 6。

    推薦理由:現場紀錄同時追蹤產品宣佈、示範失誤與後續功能場次,讀者可從發佈內容和實際操作兩方面瞭解 OpenAI DevDay 的產品進展。

  2. OpenAI News68

    OpenAI 發佈 GPT-6.1 Sol,稱其智能接近 Astra,API 輸入及輸出 token 價格為 Astra 標準價五分之一

    OpenAI 發佈 GPT-6.1 Sol,稱其面向編碼、電腦操作及專業工作,智能水平接近 Astra。其 API 輸入及輸出 token 價格均為 Astra 標準 API 對應價格的五分之一。

    推薦理由:公告把 GPT-6.1 Sol 的工作場景定位與 Astra 標準 API 輸入、輸出 token 價格作比較,便於瞭解其能力主張與定價定位。

  1. Latent Space83

    Anthropic 發佈 Claude Opus 5.5 並成為 AINews 預設模型,OpenAI 推出降價版 GPT-6 Sol 與 GPT-6 Luna

    Anthropic 發佈 Claude Opus 5.5,Latent Space 表示將其即時設為 AINews 後續內容的預設模型。Anthropic 表示其多數任務表現接近 Claude Fable 5.1,運行成本較 Opus 5 低 40%;文中補充,這項成本降幅適用於 medium 預設設定,API token 標價則下調 20%。

    推薦理由:報道並列 Claude Opus 5.5 與 GPT-6 Sol、GPT-6 Luna 的能力主張和價格變化,也區分 token 標價降幅與每任務成本,呈現不同降價口徑。

  1. OpenAI News63

    OpenAI 推出 Agents API,供建置及啟動雲端智能體

    OpenAI 推出 Agents API,這項由 Codex harness 驅動的託管服務可用於建置及啟動雲端智能體。服務支援編排、長時段工作階段與工具使用。詳情見 https://openai.com/index/introducing-the-agents-api。

    推薦理由:這則公告交代 Agents API 將編排、長時段工作階段與工具使用納入雲端智能體託管服務,清楚界定其運作範圍。

  2. OpenAI News66

    GPT‑Live‑1 為 API 帶來自然全雙工語音對話

    OpenAI 將 GPT‑Live‑1 引入 API,提供自然的全雙工語音對話及更強的指令遵循能力。它亦支援自訂聲音及電話服務。

    推薦理由:原文列出全雙工對話、指令遵循、自訂聲音及電話支援,能讓讀者迅速掌握 GPT‑Live‑1 接入 API 後涵蓋的語音能力。

  1. Ahead of AI76

    GPT-6 Astra、循環式 Transformer 與推理鏈可監控性解析

    Sebastian Raschka 分析 GPT-6 Astra 的電腦操作表現與循環式 Transformer 傳聞,指出 Astra 表現突出,但採用該架構尚未獲官方確認。

    推薦理由:文章比較循環式 Transformer 的權重共享、計算成本與路由設計,並指出現有資料尚不足以將推理鏈可監控性的變化歸因於這種架構。

  1. OpenAI News73

    OpenAI 分享 Navier–Stokes 千禧年大獎難題的 AI 生成解答

    OpenAI 分享一份針對 Navier–Stokes 千禧年大獎難題的 AI 生成解答。材料包括解説稿,以及以 Lean 撰寫的形式化證明。

    推薦理由:材料同時附上解説稿與 Lean 形式化證明,讀者可對照文字論證及形式化證明檢視這份 AI 生成解答。

  1. OpenAI News74

    GPT-6 Astra 安全概覽:網絡安全能力達 Preparedness Framework 的 Critical 級別

    OpenAI 的 GPT-6 Astra 安全概覽指出,該模型是其目前廣泛部署中能力最強的模型。它也是首個在 Preparedness Framework 下達到網絡安全能力 Critical 級別的模型。

    推薦理由:這段安全概覽同時交代 GPT-6 Astra 的部署定位與網絡安全能力級別,可供讀者把模型能力描述放回 Preparedness Framework 的評估框架理解。

  1. OpenAI News66

    ChatGPT Ads 年化收入運行率達 $1 billion,並擴展至全球

    OpenAI 宣佈,ChatGPT Ads 的年化收入運行率達 $1 billion,並擴展至全球。這項業務透過免費及平價選項,支持擴大 AI 的使用機會。

    推薦理由:材料將 ChatGPT Ads 的收入規模與全球擴展,連同免費及平價選項支持 AI 普及的方向一併交代,呈現其商業進展與使用入口之間的關聯。

  1. OpenAI News67

    OpenAI 決定在 SpaceX 收購 Cursor 後逐步結束模型供應合約

    OpenAI 決定在 SpaceX 收購 Cursor 後,逐步結束向 Cursor 提供 OpenAI 模型的合約。

    推薦理由:公告交代 Cursor 被 SpaceX 收購後,OpenAI 決定逐步結束向 Cursor 提供 OpenAI 模型的合約,呈現收購後供應合作安排的變動。