OpenAI 推出 Trusted Access for Cyber
OpenAI 推出 Trusted Access for Cyber,這是一套以信任為基礎的框架,旨在擴大前沿網絡能力的使用權限,同時加強防範濫用的保障措施。
OpenAI 推出 Trusted Access for Cyber,這是一套以信任為基礎的框架,旨在擴大前沿網絡能力的使用權限,同時加強防範濫用的保障措施。
Google 提出 Natively Adaptive Interfaces(NAI)框架,以多模態 AI 工具建立更個人化、具適應性的無障礙應用介面。NAI 主張按情境資訊作出設計決策,並以動態、由智能體驅動的模組取代靜態導覽。Gemini 原型可將即時影片轉為互動音訊描述,讓使用者即時查詢畫面細節。
OpenAI 推出 Frontier,作為建置、部署及管理 AI 智能體的企業平台。平台提供共享上下文、導入、權限及治理功能。
OpenAI 發佈 GPT-5.3-Codex,這款 Codex 原生智能體結合前沿編碼表現與通用推理,支援長週期的現實技術工作。
GPT-5.3-Codex 系統卡將該模型描述為迄今能力最強的智能體編碼模型。它結合 GPT-5.2-Codex 的前沿編碼表現,以及 GPT-5.2 的推理和專業知識能力。
Mistral AI 發佈 Voxtral Transcribe 2,包含用於批次轉寫的 Voxtral Mini Transcribe V2,以及面向即時應用的 Voxtral Realtime。
推薦理由:批次版與即時版的定位和能力差異清晰,文章亦列出即時轉寫的延遲設定、開放權重授權及兩款模型的 API 價格,便於比較部署選項。
Google Research提出 Sequential Attention,將子集選擇整合至單次模型訓練,以較低開銷提升模型效率並維持準確度。該方法以注意力分數逐步挑選特徵,在多項神經網絡基準測試中取得最先進結果。
Hugging Face Hub 推出 Community Evals,讓 benchmark 資料集託管排行榜,並在模型卡片展示評測分數。使用者可透過 PR 為任意模型提交結果,結果會標示為「community」,且可附上論文、Model Card 或評測日誌等來源。資料集可用 eval.yaml 定義評測規格,供他人重現;這項功能目前處於 beta。
推薦理由:Hugging Face 將評測規格、模型分數與社羣提交納入 Hub 的可追溯流程,Hub 的 Git 歷史記錄新增及修改時間,方便聚合比較不同來源的模型成績。
Google Research 與 Included Health 宣佈,待機構審查委員會(IRB)批准後,將在全美開展前瞻性、經參與者同意的隨機研究,評估對話式 AI 在真實虛擬醫療流程中的表現。研究將把 AI 管理患者互動的能力與限制,和標準臨牀實踐比較,從模擬研究及單中心可行性測試推進至全國規模的真實臨牀評估。
DeepSeek R1 之後,中國開源 AI 生態正由模型擴展至部署、軟硬件協同與治理,開源成為中國 AI 機構近期的主流路徑。截至 2025 年中,逾 113k 個模型以 Qwen 為基礎,逾 200k 個模型倉庫標記 Qwen,遠多於 Meta 的 Llama(27k)和 DeepSeek(6k)。
Sora 動態消息以激發創意、促進連結及保障使用體驗安全為設計理念。相關設計包括個人化推薦、家長控制及強力防護措施。
OpenAI 與 Snowflake 達成 $200M 合作,旨在將前沿智能引入企業數據。合作將在 Snowflake 中直接提供 AI 智能體與洞察。
OpenAI 推出 macOS 版 Codex app,定位為 AI 編程與軟件開發的指揮中心,支援多個智能體、平行工作流程及長時間任務。
推薦理由:公告呈現 Codex app 在 macOS 上的工作流定位,重點是以多個智能體、平行流程和長時間任務支援 AI 編程與軟件開發。
Codex app 的入門導覽聚焦其核心工作流程,概述這款應用程式的工作方式;正文沒有提供版本或可用性資訊。
作者以四組相同提示詞測試 ChatGPT(GPT-4o)、Midjourney、Nano Banana Pro、Adobe Firefly 和 Manus,比較五款 AI 圖像生成器的表現。
OpenAI 封禁了很可能源自柬埔寨、使用 AI 冒充追回服務、律師事務所及當局,並以受詐騙影響人士為目標的帳户。
OpenAI 封禁了與「No Bell」行動相關的帳户。OpenAI 表示,該行動此前未曾披露,可能源自俄羅斯,並利用 AI 為非洲各地受眾製作批評美國及其盟友的內容。
OpenAI 封禁了與一項此前未披露、由其稱為「Trolling Stone」的俄羅斯關聯影響力行動有關的帳户。該行動利用 AI 生成評論,內容涉及一名被指為俄羅斯邪教領袖的人士在阿根廷被捕。
OpenAI 封禁了與 Rybar 網絡有關、利用 AI 支援多語言影響活動的帳户。其中部分帳户可能源自俄羅斯,相關活動橫跨網站和社交平台。
OpenAI 封禁了疑似源自中國、利用 AI 研究美國人士、地點及社交工程手法的帳號。
OpenAI 封禁了極可能源自柬埔寨、利用 AI 接觸印尼尋愛者並行騙的帳户。這些帳户以 AI 協助翻譯及互動。
OpenAI 封禁了利用 AI 支援戀愛詐騙工作流程的帳户。這些流程包括主動聯絡、翻譯、與受害者互動,以及投資詐騙誘餌。
Arvind Narayanan 指出,Moravec 悖論從未經過實證檢驗,也不能用來預測哪些任務對 AI 容易或困難。他認為,AI 社羣偏重值得研究的任務、忽略對人與 AI 都過易或過難的任務,可能造成任務難度呈現表面上的負相關。由於新能力從突破到商業化和部署往往需要時間,他主張與其預測突破,不如適應已知的技術發展。
Google DeepMind 開始向美國年滿 18 歲的 Google AI Ultra 訂户逐步開放 Project Genie;這款由 Genie 3、Nano Banana Pro 和 Gemini 驅動的實驗研究原型,可建立、探索及改編互動世界。
推薦理由:原型把世界草圖、即時探索與改編放進同一體驗,並交代生成時長、物理表現和角色操控限制,可看出目前互動世界模型的使用方式與邊界。
Gradio 團隊推出開源 Python 函式庫 Daggr,可用程式串接 Gradio 應用、ML 模型及自訂函數,建立 AI 工作流程。Daggr 會自動生成視覺畫布,供使用者檢視中間輸出、修改輸入並單獨重跑步驟,同時保存工作流程狀態。該工具目前處於 beta,更新期間仍可能發生本機保存資料遺失。
Taisei Corporation 人力資源團隊正主導在整個組織推行 ChatGPT Enterprise,以推動 AI 賦能的人才培育。這項部署聚焦於培養新一代人才。
OpenAI 將於 2026 年 2 月 13 日在 ChatGPT 退役 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini。這項安排與此前已宣佈的 GPT-5(Instant、Thinking 和 Pro)退役同步;API 目前沒有變更。
Claude API 已將 Claude Sonnet 4.5、Claude Opus 4.5 和 Claude Haiku 4.5 的結構化輸出功能移出 Beta。
Google Research 團隊對 180 種智能體配置進行受控評估,提出智能體系統的量化規模化原則。在可並行的金融推理任務中,集中式協作較單智能體提升 80.9%;在 PlanCraft 的序列規劃任務中,多智能體方案則令表現下降 39–70%。研究的預測模型根據工具數量及任務可拆解程度,對 87% 未見任務配置正確識別最佳協作策略。
OpenAI 推出 EU Economic Blueprint 2.0,並納入新數據、合作夥伴關係及倡議,旨在加快歐洲各地採用 AI、發展技能並促進增長。
Hugging Face 介紹 upskill 如何以 Claude Opus 4.5 完成 CUDA kernel 任務、從任務軌跡生成 Agent 技能,再評估技能對其他模型的效果。文中一個示例中,unsloth/GLM-4.7-Flash-GGUF:Q4_0 的測試表現由 40% 升至 85%;部分模型使用技能後 token 用量反而增加,文章建議逐一比較。
OpenAI 透過內置防護措施,在 AI 智能體開啟連結時保護用户數據,防止基於 URL 的數據外洩及提示詞注入。
Google Research 提出 ATLAS 多語言 scaling laws,相關研究將於 ICLR 2026 發表,基於 774 次訓練實驗,涵蓋 10M–8B 參數模型。
Mistral AI 發佈 Mistral Vibe 2.0,這款由 Devstral 2 模型系列驅動的終端原生編碼智能體新增自訂子智能體、多選澄清、斜線命令技能及可配置工作模式。
推薦理由:Mistral Vibe 2.0 把自訂子智能體、執行前多選澄清和斜線命令技能納入終端編碼流程,具體呈現其工作流控制方式的變化。
PVH Corp. 正採用 ChatGPT Enterprise,將 AI 引入時裝設計、供應鏈及消費者互動。PVH Corp. 是 Calvin Klein 和 Tommy Hilfiger 的母公司。
TRUSTBANK 與 Recursive 合作,使用 OpenAI 模型打造 Choice AI,透過 AI 智能體為 Furusato Nozei 禮品提供個人化對話式推薦。這項服務旨在簡化用户發掘禮品的流程。
OpenAI 推出 Prism,這是一個免費的 LaTeX 原生工作區,內置 GPT-5.2。它旨在讓研究者在同一處進行寫作、協作與推理。
推薦理由:Prism 把研究者的寫作、協作與推理集中在一個免費的 LaTeX 原生工作區,並內置 GPT-5.2,呈現其面向研究工作的整合定位。
Manus AI 宣佈將全面整合 Agent Skills,並推出把成功工作流程封裝為 Skill 的功能及 /SKILL_NAME 斜線命令。Skills 採用漸進式披露,啟動時載入 metadata(約 100 tokens/Skill),觸發時載入 SKILL.md(<5k tokens),其他資源按需載入。
Indeed CRO Maggie Hulce 分享 AI 如何改變求職、招聘及人才招募,內容涵蓋僱主與求職者。
Google Research 在 NeurIPS 2025 介紹 GIST,這種資料子集選取演算法兼顧多樣性與效用。GIST 保證所選子集的價值至少達絕對最優解價值的一半,並在圖像分類等基準任務中超越最先進方法。
最多提供 50 頁,更早的內容請使用搜尋或主題頁。