全球開源 AI 生態的未來:從 DeepSeek 到 AI+
DeepSeek R1 之後,中國開源 AI 生態正由模型擴展至部署、軟硬件協同與治理,開源成為中國 AI 機構近期的主流路徑。截至 2025 年中,逾 113k 個模型以 Qwen 為基礎,逾 200k 個模型倉庫標記 Qwen,遠多於 Meta 的 Llama(27k)和 DeepSeek(6k)。
DeepSeek R1 之後,中國開源 AI 生態正由模型擴展至部署、軟硬件協同與治理,開源成為中國 AI 機構近期的主流路徑。截至 2025 年中,逾 113k 個模型以 Qwen 為基礎,逾 200k 個模型倉庫標記 Qwen,遠多於 Meta 的 Llama(27k)和 DeepSeek(6k)。
Sora 動態消息以激發創意、促進連結及保障使用體驗安全為設計理念。相關設計包括個人化推薦、家長控制及強力防護措施。
OpenAI 與 Snowflake 達成 $200M 合作,旨在將前沿智能引入企業數據。合作將在 Snowflake 中直接提供 AI 智能體與洞察。
OpenAI 推出 macOS 版 Codex app,定位為 AI 編程與軟件開發的指揮中心,支援多個智能體、平行工作流程及長時間任務。
推薦理由:公告呈現 Codex app 在 macOS 上的工作流定位,重點是以多個智能體、平行流程和長時間任務支援 AI 編程與軟件開發。
OpenAI 封禁了很可能源自柬埔寨、使用 AI 冒充追回服務、律師事務所及當局,並以受詐騙影響人士為目標的帳户。
OpenAI 封禁了與「No Bell」行動相關的帳户。OpenAI 表示,該行動此前未曾披露,可能源自俄羅斯,並利用 AI 為非洲各地受眾製作批評美國及其盟友的內容。
OpenAI 封禁了與一項此前未披露、由其稱為「Trolling Stone」的俄羅斯關聯影響力行動有關的帳户。該行動利用 AI 生成評論,內容涉及一名被指為俄羅斯邪教領袖的人士在阿根廷被捕。
OpenAI 封禁了與 Rybar 網絡有關、利用 AI 支援多語言影響活動的帳户。其中部分帳户可能源自俄羅斯,相關活動橫跨網站和社交平台。
OpenAI 封禁了疑似源自中國、利用 AI 研究美國人士、地點及社交工程手法的帳號。
OpenAI 封禁了極可能源自柬埔寨、利用 AI 接觸印尼尋愛者並行騙的帳户。這些帳户以 AI 協助翻譯及互動。
OpenAI 封禁了利用 AI 支援戀愛詐騙工作流程的帳户。這些流程包括主動聯絡、翻譯、與受害者互動,以及投資詐騙誘餌。
Google DeepMind 開始向美國年滿 18 歲的 Google AI Ultra 訂户逐步開放 Project Genie;這款由 Genie 3、Nano Banana Pro 和 Gemini 驅動的實驗研究原型,可建立、探索及改編互動世界。
推薦理由:原型把世界草圖、即時探索與改編放進同一體驗,並交代生成時長、物理表現和角色操控限制,可看出目前互動世界模型的使用方式與邊界。
Gradio 團隊推出開源 Python 函式庫 Daggr,可用程式串接 Gradio 應用、ML 模型及自訂函數,建立 AI 工作流程。Daggr 會自動生成視覺畫布,供使用者檢視中間輸出、修改輸入並單獨重跑步驟,同時保存工作流程狀態。該工具目前處於 beta,更新期間仍可能發生本機保存資料遺失。
Taisei Corporation 人力資源團隊正主導在整個組織推行 ChatGPT Enterprise,以推動 AI 賦能的人才培育。這項部署聚焦於培養新一代人才。
OpenAI 將於 2026 年 2 月 13 日在 ChatGPT 退役 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini。這項安排與此前已宣佈的 GPT-5(Instant、Thinking 和 Pro)退役同步;API 目前沒有變更。
Google Research 團隊對 180 種智能體配置進行受控評估,提出智能體系統的量化規模化原則。在可並行的金融推理任務中,集中式協作較單智能體提升 80.9%;在 PlanCraft 的序列規劃任務中,多智能體方案則令表現下降 39–70%。研究的預測模型根據工具數量及任務可拆解程度,對 87% 未見任務配置正確識別最佳協作策略。
OpenAI 推出 EU Economic Blueprint 2.0,並納入新數據、合作夥伴關係及倡議,旨在加快歐洲各地採用 AI、發展技能並促進增長。
Hugging Face 介紹 upskill 如何以 Claude Opus 4.5 完成 CUDA kernel 任務、從任務軌跡生成 Agent 技能,再評估技能對其他模型的效果。文中一個示例中,unsloth/GLM-4.7-Flash-GGUF:Q4_0 的測試表現由 40% 升至 85%;部分模型使用技能後 token 用量反而增加,文章建議逐一比較。
OpenAI 透過內置防護措施,在 AI 智能體開啟連結時保護用户數據,防止基於 URL 的數據外洩及提示詞注入。
Google Research 提出 ATLAS 多語言 scaling laws,相關研究將於 ICLR 2026 發表,基於 774 次訓練實驗,涵蓋 10M–8B 參數模型。
Mistral AI 發佈 Mistral Vibe 2.0,這款由 Devstral 2 模型系列驅動的終端原生編碼智能體新增自訂子智能體、多選澄清、斜線命令技能及可配置工作模式。
推薦理由:Mistral Vibe 2.0 把自訂子智能體、執行前多選澄清和斜線命令技能納入終端編碼流程,具體呈現其工作流控制方式的變化。
PVH Corp. 正採用 ChatGPT Enterprise,將 AI 引入時裝設計、供應鏈及消費者互動。PVH Corp. 是 Calvin Klein 和 Tommy Hilfiger 的母公司。
TRUSTBANK 與 Recursive 合作,使用 OpenAI 模型打造 Choice AI,透過 AI 智能體為 Furusato Nozei 禮品提供個人化對話式推薦。這項服務旨在簡化用户發掘禮品的流程。
OpenAI 推出 Prism,這是一個免費的 LaTeX 原生工作區,內置 GPT-5.2。它旨在讓研究者在同一處進行寫作、協作與推理。
推薦理由:Prism 把研究者的寫作、協作與推理集中在一個免費的 LaTeX 原生工作區,並內置 GPT-5.2,呈現其面向研究工作的整合定位。
Indeed CRO Maggie Hulce 分享 AI 如何改變求職、招聘及人才招募,內容涵蓋僱主與求職者。
Google Research 在 NeurIPS 2025 介紹 GIST,這種資料子集選取演算法兼顧多樣性與效用。GIST 保證所選子集的價值至少達絕對最優解價值的一半,並在圖像分類等基準任務中超越最先進方法。
OpenAI 深入剖析 Codex 智能體循環,説明 Codex CLI 如何透過 Responses API 協調模型、工具、提示詞與效能。
Google Research提出分解式流程,令小型多模態 LLM 從網頁及手機互動軌跡提取意圖,表現勝過 CoT 提示和端到端微調。流程先逐屏摘要,再從摘要序列抽取整體意圖;測試涵蓋手機、網頁軌跡及 Gemini、Qwen2 基礎模型。Gemini 1.5 Flash 8B 配合此法,效果可媲美 Gemini 1.5 Pro,展示裝置端意圖理解的應用潛力。
OpenAI 擴展 PostgreSQL 以支撐 800 million ChatGPT 用户,並將其處理規模提升至每秒數百萬次查詢。所述做法包括使用副本、快取、速率限制及工作負載隔離。
這份數據報告分析各行業員工如何使用 ChatGPT,涵蓋採用趨勢、主要任務及部門使用模式。報告亦探討 AI 在工作場所的未來。
Praktika 運用 GPT-4.1 和 GPT-5.2 打造適應型 AI 導師,為學習者個人化課程並追蹤學習進度。這些導師協助學習者提升實際語言流利度。
Mistral AI 團隊追查 vLLM 分離式服務的記憶體洩漏,定位到 UCX 的 mmap hook 與延後清理的記憶體池。問題只在使用 NIXL 的 Prefill/Decode 分離式設定中重現;設置 UCX_MEM_MMAP_HOOK_MODE=none 可解決洩漏,且在此 vLLM 用例中不影響效能。
推薦理由:這篇排查記錄示範如何從 RSS 與匿名映射的異常增長開始,逐步利用 BPFtrace 和 GDB 定位 UCX mmap hook,並整理 vLLM 分離式服務可用的修復設定。
AssetOpsBench 是面向工業資產運維的 AI 智能體基準與評估系統,從六項質性維度評估智能體表現。它涵蓋 2.3M 個感測遙測點、4.2K 張工單及 53 種結構化失效模式,並以 881 條執行軌跡分析失敗。社羣測試中,沒有受測模型達到部署準備門檻 85 分;多智能體任務準確率為 47%,低於單智能體的 68%。
OpenAI 最新報告指出,各國採用先進 AI 的程度差異顯著。報告提出新倡議,協助各國取得 AI 帶來的生產力增益。
OpenAI 推出 Edu for Countries,這項新計劃協助各國政府運用 AI 推動教育系統現代化,並建設面向未來的勞動力隊伍。
OpenAI 與 Gates Foundation 啟動 Horizon 1000,推出一項 $50M 試點計劃,旨在提升非洲基層醫療領域的 AI 能力。計劃目標是到 2028 年觸及 1,000 間診所。
推薦理由:這項試點列出 $50M 投入及到 2028 年觸及 1,000 間診所的目標,呈現 OpenAI 與 Gates Foundation 在非洲推進醫療 AI 的規劃規模。
Stargate Community 計劃以社區優先方式規劃 AI 基礎設施,並按地方情況調整方案。方案會參考社區意見、能源需求及勞動力優先事項制定。
ServiceNow 擴大對 OpenAI 前沿模型的存取,藉此支援 ServiceNow Platform 上的 AI 驅動企業功能。支援範圍包括企業工作流程、摘要、搜尋及語音。
Overworld 發佈 Waypoint-1,這款即時互動影片擴散模型可透過文字、滑鼠和鍵盤控制,並按控制輸入逐影格生成。模型以 10,000 小時配有控制輸入及文字描述的多樣化遊戲影片訓練,並以 self-forcing 後訓練,令訓練更貼近逐影格推理。
推薦理由:Waypoint-1 從訓練之初便以互動體驗為目標,與常見的先用預訓練影片模型、再微調簡化控制輸入的做法形成對照。
ChatGPT 正推出年齡預測功能,用以估算帳户使用者是否未滿或超過 18 歲。系統會為青少年套用安全防護,並隨時間改進預測準確度。