OpenAI 在網絡關鍵能力時代調控模型開發步伐
OpenAI 正加強前沿 AI 模型的監測、對齊與安全防護。在網絡關鍵能力時代,這些新防護措施正引導模型開發步伐。
OpenAI 正加強前沿 AI 模型的監測、對齊與安全防護。在網絡關鍵能力時代,這些新防護措施正引導模型開發步伐。
OpenAI 推出 ChatGPT for Teens,協助青少年學習、批判思考,並更有信心地使用 AI。產品內置更強防護措施和健康使用功能,亦為家長提供額外控制選項。
OpenAI 與 CodeAI 展開合作,協助學生建立 AI 素養、批判性思考能力,並培養負責任地運用及塑造 AI 的技能。
Asana 使用 OpenAI Codex,在 2 週內替換一套過時的測試系統,並完成原需數年的程式碼遷移。此次使用的模型與基礎設施成本約為 $12K。
NVIDIA 團隊使用 ChatGPT Work 減少手動任務、串連快速變化的訊號,並在全球擴展成功的工作流程。
Sentence Transformers v6.0 新增 MultiVectorEncoder,支援 ColBERT 式多向量檢索。文中示範載入 PyLate 與 Stanford-NLP ColBERT checkpoint、接入檢索索引,以及以同一 API 執行 ColPali 視覺文件檢索。
推薦理由:文章對照 LateOn 與 DenseOn 在 NanoBEIR 13 個資料集的結果,並以索引體積數據呈現多向量檢索表現與儲存成本的取捨。
OpenAI 説明如何加強自身網絡安全防禦,並指出資安團隊現階段可採取的行動。AI 正同時重塑攻擊者與防守者的網絡安全工作。
OpenAI 資助 14 個獨立項目,探索旨在擴大經濟機會並增強社會韌性的智能時代新 AI 政策構想。
Google DeepMind 發佈 Gemini 3.7 Flash,稱其在編碼、知識工作及網頁開發工作流上較 Gemini 3.6 Flash 有所提升。
推薦理由:文章列出 Gemini 3.7 Flash 在編碼、網頁開發和複雜文件基準上的對比數據,並交代入門價格,便於衡量效能與成本取捨。
OpenAI 的 GPT-5.6 建構指南聚焦初創公司如何運用 GPT-5.6,更快、更具成本效益地構建 AI 智能體。指南亦涵蓋更智能的模型選擇,以及 Responses API 的新能力。
OpenAI 預覽新的 API 服務層 Ultrafast,為 GPT-5.6 Sol 提供最高 14× 的速度提升。該服務由 Cerebras 提供支援,輸出速度最高可達每秒 750 個 token。
OpenAI 任命 Dali Rajic 出任首席營收官,負責領導其全球營收組織,並協助企業充分實現 AI 的全部價值。
OlmoEarth Studio 新增自訂嵌入向量匯出功能,輸出可用於下游分析的 COG。使用者可設定研究區域、時間範圍、編碼器、解析度及影像來源;文章示範相似度搜尋、少樣本分割、變化檢測和 PCA 探索。以 60 個標註像素訓練的分類器取得 weighted F1 = 0.84,匯出檔可用於 QGIS、GDAL、rasterio 等工具。
Google DeepMind 發佈 SL2T 多語言手語轉文字模型,為 Gboard 和 Live Transcribe 帶來手語轉文字功能,首階段支援 ASL 至英文。
推薦理由:SL2T 以簽署者的身體姿態座標直接翻譯成文字,原始影片會即時丟棄,呈現其輸入處理方式與私隱保護設計。
Google Research 提出 knowledge profiling 框架及 WikiProfile 基準,發現前沿大語言模型的事實性錯誤更多源於已編碼事實難以回憶,而非未能編碼。
推薦理由:研究以 WikiProfile 分別測量事實編碼、回憶與識別,將模型事實性錯誤區分為知識缺失或提取失敗,提供比單看答題準確率更細的診斷視角。
OpenAI 研究揭示企業正採用智能體 AI,並使用 ChatGPT 和 Codex。前沿企業在 AI 採用方面正拉開差距。
RingCentral 使用 ChatGPT Work 和 Codex 加速 AI 產品開發,並集中工程與營運部門的營運情報。相關應用涵蓋工程至營運。
Google Research 展示基於 Gemini 和 Project Astra 的 AMIE (Video),在模擬即時視像會診中,核心臨牀能力獲評與基層醫生相當。
推薦理由:研究以 300 場模擬視像會診比較 AMIE (Video)、文字版 AMIE 與基層醫生,呈現視聽感知和虛擬檢查的表現差異,並交代病人演員研究的適用邊界。
OpenAI 開始在 ChatGPT 測試廣告,以支持免費使用。測試安排包括清晰標示廣告、維持答案獨立、提供強力私隱保障,並保留用户控制。
推薦理由:材料列出 OpenAI 測試 ChatGPT 廣告時的設計邊界,包括清晰標示、答案獨立、私隱保障及用户控制,呈現其支持免費使用時採取的安排。
OpenAI 與 AWS 現透過 Amazon Bedrock 提供 Daybreak 網絡安全能力,支援企業安全工作流程。
OpenAI CFO Sarah Friar 分享打造 AI 原生財務職能的五點啟示,內容涵蓋自動化預測、加強控制與 AI 投資回報。這些經驗聚焦財務職能的 AI 原生建構。
NVIDIA Magpie Multilingual TTS 最新版本擴展至 12 種語言,是一款 364M 參數、開放權重的語音合成模型,可部署於自有基礎設施並按工作負載調校。
OpenAI 致函德州州長 Greg Abbott,闡述其對在德州負責任地發展 AI 基礎設施的承諾。信中支持可靠、透明且惠及德州居民的增長。
OpenAI 讓獲批的 Daybreak 合作夥伴使用其前沿網絡安全模型,向客户提供獲授權、受管治的網絡安全服務。
OpenAI 公佈網絡安全專用模型 GPT-5.6-Cyber,該模型透過 Daybreak Red 提供,用於經授權的漏洞研究、漏洞利用驗證及安全測試。相關頁面:https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows
Virgin Atlantic 藉助 ChatGPT Work 協助團隊串聯客户旅程中的各項訊號。這項應用正加快研究、產品規劃與決策。
Zapier 的企業市場推廣團隊使用 ChatGPT Work 改造核心流程,以減少潛在客户漏斗中的流失。團隊亦用它製作宣傳活動素材並自動化報告。
Meta 發佈 Muse Glimmer,一款由 Muse 蒸餾而來、面向本地智能體應用的多模態 30B 模型,採用 Apache 2.0 授權。模型由 2B ViT-style 視覺編碼器和 28B 文字解碼器組成,支援圖像、影片輸入及多模態工具調用。
推薦理由:文章把 Muse Glimmer 的本地智能體定位、30B 架構與 transformers、llama.cpp、vLLM 等入口連起來,提供從本地推理到託管部署的實作參考。
OpenAI 已在 ChatGPT Business 推出 Premium seats,提供 5x 使用量,且不設五小時使用上限。方案亦為每位團隊成員提供彈性席位選項。
HSP GRUPPE 使用 ChatGPT Enterprise 提升生產力和工作質素,並為税務諮詢及客户服務創造更多容量。
OpenAI 改進 ChatGPT 中的 GPT-5.6 Sol,提升其準確度與一致性,並擴大免費用户使用 GPT-5.6 Luna 的範圍。免費用户可與 GPT-5.6 Luna 進行不限量的日常聊天。
推薦理由:公告交代 GPT-5.6 Sol 在準確度與一致性上的提升,並説明免費用户可與 GPT-5.6 Luna 進行不限量的日常聊天,呈現模型調整與使用範圍的變化。
OpenAI 與美國心理學會合作推進以證據為本的指引、資源及保障措施,聚焦負責任使用 AI 與青年心理健康。
OpenAI Signals 數據呈現全球各地使用 ChatGPT 的情況,涵蓋各國採用情況、使用趨勢及不斷演變的使用行為。
OpenAI 説明近期涉及其模型的第三方網絡安全評估事件,並提出新防護措施,以強化 AI 模型的測試與評估。
Mistral AI 發佈 Shieldstral,一款 3B 開放權重多模態安全分類器,可用自然語言政策評估文字與圖像,無須重新訓練。它將內容審核設計為可在推理時指定政策的二元問答,並輸出校準後的安全分數;Mistral 稱其在多項基準上匹配或超越模型規模最高達其 7x 的開放權重安全模型。
推薦理由:將審核政策置於推理時的自然語言問題中,使同一個 3B 模型可按部署情境調整文字與圖像判斷,無須重新訓練。
OpenAI 為 ChatGPT Work 和 Codex 推出新的教育外掛,面向 K–12 教師、大專院校教育工作者及學生。外掛協助他們學習、教學、研究和構建。
OpenAI 回應 Apple 提起的訴訟,稱其缺乏根據,並澄清有關 OpenAI 員工的説法。OpenAI 亦公開相關訊息,記錄事件經過。
OpenAI 用六個月構建 GPT-Live 即時語音系統,支援與 AI 持續進行語音互動。系統採用無需輪次切換的語音模型和低延遲架構,以實現更快、更自然的對話。
Circles 使用 OpenAI API 和 Codex 打造 AI 原生電信體驗,ARPU 提升 22%、客户流失率降低 9%,並提升開發效率。
OpenAI 分享數學與理論計算機科學的十項進展,涉及長期未解問題。成果涵蓋幾何、密碼學及複雜性。