OpenAI 推動歐洲負責任 AI 發展
OpenAI 分享其安全、保安、透明度及來源追溯實踐如何支持歐洲的負責任 AI 治理。隨着 EU AI Act 推進,相關工作將持續進行。
OpenAI 分享其安全、保安、透明度及來源追溯實踐如何支持歐洲的負責任 AI 治理。隨着 EU AI Act 推進,相關工作將持續進行。
Univé 運用 ChatGPT Enterprise,結合領導層推動、負責任治理與員工主導的創新,打造為 AI 做好準備的員工隊伍。這套做法旨在大規模轉變工作方式。
OpenAI 瓦解了一個以柬埔寨為基地的犯罪詐騙行動。該行動利用 ChatGPT 協助進行投資、戀愛、賭博及冒充詐騙。
Google Research 提出 Chain-of-Evidence(CoE)可驗證研究框架,並以 Science One Framework 展示如何在自主研究中為每項主張建立證據鏈。
Google DeepMind 發佈 Gemini Robotics ER 2,這款面向機械人的具身推理模型可理解連續影片、編排多步任務,並支援多機械人協作。它在任務進度分類達 57.4% 準確率,關鍵時刻定位達 91.3% 準確率、平均絕對距離為 0.96s。
推薦理由:文章將影片進度追蹤與多機械人協作納入模型更新,並提供任務評測數據,讓讀者掌握 Gemini Robotics ER 2 的具身推理能力變化。
avatarin 使用 OpenAI 的 GPT-Realtime,為 Yamada Denki 顧客提供 24/7 多語言支援。該智能體在兩週內有 30,000 人使用,調查回覆中 92% 為正面。
Google DeepMind 今日在 Google Flow Music 推出音樂生成模型 Lyria 3.5,並提升旋律、歌詞及人聲生成品質。它可生成更豐富、複雜且自然的旋律結構,並改善歌詞的提示詞遵循度與結構意識,以及人聲的真實感、情感細膩度和發音。使用者也可更容易控制生成內容的節奏和時長。
OpenAI 向 100,000 名學術研究人員免費提供 ChatGPT 最先進 AI 模型的使用權,以加速科學研究、協作與發現。
推薦理由:免費使用權涵蓋 100,000 名學術研究人員,讓讀者可把握這項科研支持安排所面向的羣體與規模。
GPT-5.6 提升 AI 在模型、推理及智能體工作流程各方面的效率,有助於讓每一美元帶來更多實用智能。
科學家正運用 AI 編碼智能體推動科學計算現代化,加快基因組學及其他領域的軟件開發與發現。
Google DeepMind 發佈 Gemini Robotics 2 系列模型,為機械人帶來全身控制、靈巧操作及多機協作能力。系列包括將視覺與語言輸入轉為動作控制的 Gemini Robotics 2、用於具身推理與多步任務規劃的 Gemini Robotics ER 2,以及可在機械人裝置本地運行的 Gemini Robotics On-Device 2。
推薦理由:全身控制、靈巧操作、多機協作與本地適配均有具體案例,呈現 Gemini Robotics 2 系列面向機械人任務的能力佈局。
NVIDIA 發佈 Cosmos-H-Dreams,一款根據機械人動作即時生成手術場景影片的模擬器。它將 Cosmos-H-Surgical-Simulator 蒸餾為因果學生模型,並透過 FlashDreams 在單張 NVIDIA RTX PRO 6000 上達到約 160 fps。
OpenAI 的新研究指出,AI 正擴展工作者承擔的工作範圍。ChatGPT 用户承接不同職務範疇的任務,並重塑職務界線。
OpenAI 推出 ChatGPT 的 Health 功能,讓符合資格的美國用户安全連接醫療紀錄和 Apple Health。用户可藉此獲取更個人化的洞察,並更瞭解自身健康。
推薦理由:材料交代了 Health 的適用對象、可連接的健康資料來源及預期用途,便於瞭解這項功能的使用範圍。
Diffusers 現已原生支援 Nunchaku Lite 的 4-bit 擴散模型推理,預量化檢查點可用 `from_pretrained()` 載入,無須獨立推理引擎或本機編譯 CUDA。
推薦理由:文章説明 Nunchaku Lite 在 Diffusers 的原生載入方式,並以 RTX PRO 6000 基準量化呈現延遲與顯存變化。
Google Research 以 13,917 名參與者評估 SymptomAI,臨牀專家在逾 50% 個案中偏好其鑑別診斷。主動追問的智能體策略在鑑別診斷準確度上顯著優於 Base 條件;研究亦發現 SymptomAI 的呼吸道感染診斷分類與症狀報告前的 Fitbit 生理訊號變化相符。研究產生的診斷僅供研究分析,不構成確認的臨牀診斷或正式醫療評估。
Google Research 在 Willow 超導量子處理器上驗證強化學習控制,讓系統依錯誤檢測訊號在運算中持續校準。刻意注入控制參數漂移後,該方法使錯誤更正碼的邏輯穩定性提升 3.5 倍;專家校準後再經 RL 微調,邏輯錯誤率額外降低 20%。涵蓋數百個 qubit 和數萬個控制參數的數值模擬顯示,所需 RL 訓練迭代次數不隨系統規模變化。
Google 在 DOE Genesis Mission Summit 2026 宣佈,將提供 $40 million 的 AI tokens 和雲端額度,支持 Genesis Mission 研究人員。
推薦理由:承諾同時涵蓋科學 AI 工具與 Gemini for Government 一年使用權,並附有顯微鏡校準時間及手動步驟的前後數據,可見資源投入如何落到實驗室工作流程。
各地新聞機構正運用 AI 強化新聞報道、拓展受眾,並改善業務營運。OpenAI 工具支援全球各地的記者及出版商。
OpenAI 表明將與美國能源部及國家實驗室合作,運用前沿 AI 加速科學發現。此舉旨在推進美國科學發展。
OpenAI 推出 OpenAI Presence,一個經驗證的企業 AI 智能體平台,協助機構部署可信賴的語音及聊天智能體,以支援客户與內部工作流程。
NTT DATA Group 使用 ChatGPT Enterprise 和 Codex,協助 9,000 名員工自動化工作,並將事故分析縮短至 30 分鐘。該集團亦擴大安全採用 AI 的規模。
OpenAI 推出 ChatGPT for Small Businesses 計劃,協助創業者培養 AI 技能、自動化工作,並透過 ChatGPT Work 發展業務。
Google DeepMind 發佈 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,涵蓋智能體工作流、低延遲高吞吐任務及網絡安全場景。
推薦理由:文章列出 3.6 Flash 與 3.5 Flash-Lite 的速度及成本指標,並説明 Cyber 模型將透過有限試點提供,呈現不同工作負載的部署差異。
OpenAI 與 Hugging Face 分享 AI 模型評估期間安全事故的初步調查結果。結果聚焦進階網絡能力,以及防守方可汲取的教訓。
Pollen Robotics 發佈開源、低成本的 Grabette 手持式系統,可記錄人工操作示範並轉成機械人訓練數據集。裝置配備兩部攝影機,瀏覽器處理流程透過 RTAB-MAP 執行 SLAM,並輸出 LeRobot 格式數據;Grabette 的物料清單成本約 490€。
推薦理由:Grabette 把手持式示範、SLAM 軌跡處理與 LeRobot 數據集串成採集流程,並以 200 段示範呈現訓練及機械臂評估的端到端用法。
David Vélez 與 Robin Vince 加入 OpenAI Foundation 及 OpenAI Group PBC 董事會,為兩個董事會帶來金融、科技與治理領域的全球領導經驗。
OpenAI 分享部署長時程 AI 模型的經驗教訓,指出新出現的安全風險及已觀察到的失效情況。公司表示,透過迭代部署改進防護措施。
Google DeepMind 發佈 Gemini 3.5 Flash Cyber,這款基於 3.5 Flash 並經微調的輕量網絡安全模型,旨在快速發現、驗證及修補漏洞。
推薦理由:V8 JavaScript Engine 的固定調用測試提供了具體比較,Gemini 3.5 Flash Cyber 找到 55 個獨特確認問題,主線 3.5 Flash 與 Claude Opus 4.6 分別找到 47 個和 36 個。
OpenAI CFO Sarah Friar 提出一份用於衡量 AI 投資回報的實用記分卡。評估維度包括有用工作、每項成功任務的成本、可靠性及算力回報。
OpenAI 正透過符合年齡的保護措施、學習工具、家長控制功能及專家合作,提升 ChatGPT 對青少年的安全保障。
Google DeepMind 與 Isomorphic Labs 公佈聯合生物韌性方案,將工作分為防止威脅者濫用 AI 模型,以及運用 AI 支援疫情預防、檢測和應對兩部分。
OpenAI 的創意團隊運用 Codex 和上下文感知 AI 建構自訂創意工具、加快構思,並更快製作原型。
Hugging Face 披露,其部分生產基礎設施遭自主 AI 智能體系統入侵,攻擊者存取了有限範圍的內部資料集及多項服務憑證。Hugging Face 已封堵相關程式碼執行路徑、重建受影響節點並輪換憑證;目前未發現公開、面向用户的模型、資料集或 Spaces 遭篡改,合作夥伴或客户資料是否受影響仍在評估。
推薦理由:事件呈現託管模型安全護欄對事故分析的限制,也提供可遷移的準備方向,即預先驗證能在自有基礎設施運行的模型,以保護攻擊資料並維持調查能力。
Cars24 使用 OpenAI 驅動的語音與聊天智能體,每月處理 1M+ 分鐘對話,並挽回 12% 流失潛在客户。公司亦將智能體工作流程推廣至各團隊,藉助 OpenAI 加快構建。
OpenAI 提出 AI 治理的「逆向聯邦主義」方案,主張由州級法律協助建立全國性的安全、民主 AI 框架。這一方向透過州與聯邦行動推進美國 AI 安全。
OpenAI 的 GPT-Red 是一套自動化紅隊測試系統,運用自我對弈提升 AI 安全性、對齊及抵禦提示詞注入的能力。
Real World VoiceEQ 是一套衡量語音 AI 真人互動品質的新基準,評估 40+ 款專有及開源語音模型,涵蓋 15+ 個評測維度和 60+ 項指標。基準以超過 1 million 次人工評分建立,評測範圍包括 ASR、TTS、S2S 和 Speech Understanding。結果顯示,各模型能力各有側重,而傳統基準可能高估模型在真實對話中的表現。
企業在智能體時代可透過衡量每美元產出的有用工作量、提升效率及擴展高價值工作流程,管理 AI 投資。
ChatGPT Work 的實用數據科學工作流程涵蓋根因簡報、KPI 備忘錄、限定範圍分析及儀錶板規格,説明如何在這些任務中運用相關工作流程。