OpenAI 如何應對《紐約時報》的資料要求以保護用户私隱
OpenAI 正在抗辯一項應《紐約時報》及原告方要求、涉及無限期保留 ChatGPT 消費者及 API 用户資料的法院命令。OpenAI 表示,正致力於維護用户私隱、處理法律要求,並遵守其資料保護承諾。
推薦理由:材料呈現了訴訟要求與用户私隱承諾之間的直接衝突,並交代爭議涉及 ChatGPT 消費者及 API 用户資料的無限期保留。
OpenAI 正在抗辯一項應《紐約時報》及原告方要求、涉及無限期保留 ChatGPT 消費者及 API 用户資料的法院命令。OpenAI 表示,正致力於維護用户私隱、處理法律要求,並遵守其資料保護承諾。
推薦理由:材料呈現了訴訟要求與用户私隱承諾之間的直接衝突,並交代爭議涉及 ChatGPT 消費者及 API 用户資料的無限期保留。
OpenAI 的 2025 年 6 月報告以案例説明其如何偵測並阻止 AI 的惡意用途。
Mistral AI 推出 Mistral Code,將編碼模型、IDE 助手、部署選項及企業管理工具整合為面向企業的 AI 編碼助手。產品現已為 JetBrains IDEs 和 VSCode 開放私測,正式版計劃稍後推出,部署方式包括 serverless、雲端及自託管。
H Company 發佈 Holo1 開源 VLM 系列及 WebClick UI 定位基準,後者收錄 1,639 項 UI 任務。Holo1 系列包括 Holo1-3B 和 Holo1-7B,後者在常見 UI 定位基準的平均準確率為 76.2%。Surfer-H 採用 Holo1 開放權重模型;H Company 稱,該智能體在真實網頁任務上的準確率為 92.2%,每項任務成本為 $0.13。
Hugging Face 發佈 SmolVLA,一款 450M 開源 Vision-Language-Action(VLA)機械人模型,以 LeRobot 社羣數據預訓練,可在消費級硬件上運行。
推薦理由:文中比較社羣數據預訓練前後的成功率,以及同步與非同步推理的完成時間和吞吐量,呈現數據與推理架構各自帶來的變化。
OpenAI 封禁了利用 AI 進行社交工程、以監控為主題的研究,以及針對批評者開展影響活動的帳户。
OpenAI 封禁了使用 AI 開發惡意軟件、改進載入器及排查網絡安全工具問題的俄語帳户。「Operation ScopeCreep」聚焦俄語惡意軟件開發。
OpenAI 在「Sneer Review」行動中封禁了利用 AI 生成批評台灣社交媒體網紅及相關美國議題貼文的帳户。該行動被描述為源自中國的影響活動。
OpenAI 在「High Five」行動中封禁了利用 AI 在多個社交平台生成菲律賓政治及公職人員相關評論的帳户。
OpenAI 封禁了與疑似和伊朗有關的 STORM-2035 行動相關聯的帳户。該行動利用 AI 製作涉及美國、英國、愛爾蘭及委內瑞拉政治的影響力內容。
OpenAI 封禁了與被公開歸因於中華人民共和國的威脅行為者相關的帳户。相關行為者曾使用 AI 支援漏洞研究、腳本編寫、翻譯及作業故障排查。
Wix 的 AI Website Builder 由 OpenAI 提供支援,讓任何人只需在對話中描述構想,便可在數分鐘內建立完整網站。
Mistral AI 發佈首款程式碼專用嵌入模型 Codestral Embed,面向真實程式碼檢索。官方稱其檢索表現優於 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大型嵌入模型;採用 256 維、int8 精度時仍優於競品。
Mistral AI 發佈 Agents API,將內置連接器、跨對話記憶及智能體編排整合為構建 AI 智能體的框架。內置連接器涵蓋代碼執行、網絡搜索、圖像生成、Document Library 及 MCP 工具;啟用網絡搜索後,Mistral Large 和 Mistral Medium 在 SimpleQA 的分數分別由 23% 和 22.08% 升至 75% 和 82.32%。
推薦理由:Agents API 把內置連接器、跨對話記憶和多智能體編排納入同一框架,並以 SimpleQA 數據呈現網絡搜索前後的分數差異。
OpenAI 將 Operator 原有基於 GPT-4o 的模型,替換為基於 OpenAI o3 的版本。Operator 的 API 版本仍基於 4o。這項變更收錄於 OpenAI o3 與 o4-mini 系統卡補充文件。
CodeRabbit 使用 OpenAI 的 o3、o4-mini 和 GPT-4.1 進行程式碼審查,提升審查準確度並加快 PR 合併。這亦協助開發者更快交付程式碼、減少錯誤並提高 ROI。
OpenAI 正啟動 Stargate UAE,這是其 AI 基礎設施平台 Stargate 的首個國際部署。
推薦理由:原文將 Stargate UAE 定位為 Stargate 的國際部署,提供理解 OpenAI AI 基礎設施平台海外部署脈絡的具體案例。
Mistral AI 發佈與 All Hands AI 合作打造的 Devstral,這款面向軟件工程任務的智能體大語言模型以 Apache 2.0 授權免費開源。
推薦理由:Devstral 在 SWE-Bench Verified 得分 46.8%,較此前開源 SoTA 高逾 6 個百分點,讓模型處理真實 GitHub issue 的基準表現有量化參照。
Falcon-LLM Team 發佈 Falcon-H1 開放權重混合架構模型系列,涵蓋六種規模、由 0.5B 至 34B,並提供 base 與 instruction-tuned 版本。
推薦理由:文中對照 Qwen2.5-32B 的短、長上下文吞吐,並説明混合 Attention-SSM 設計,呈現 Falcon-H1 隨序列長度變化的效率取捨。
阿聯酋 Technology Innovation Institute(TII)推出 Falcon-Arabic,這款基於 Falcon 3 架構的 7B 參數模型支援阿拉伯語、英語及其他語言。它在 OALL v2 評測中勝過同規模阿拉伯語 LLM,並超越規模大至 4× 的模型。其上下文窗口為 32,000 tokens,可處理長文件並支援 RAG 等應用。
Hugging Face Diffusers 文章比較五種量化後端在 FLUX.1-dev 上的記憶體佔用與推理時間。BF16 載入後約佔 31.447 GB,bitsandbytes 4-bit 為 12.584 GB、推理需 12 秒;torchao int4_weight_only 為 10.635 GB,但推理需 109 秒。
Microsoft 與 Hugging Face 擴大合作,Azure AI Foundry 現提供 10,000+ 個 Hugging Face 模型供部署,涵蓋文字、音訊和圖像等任務。
Hugging Face 表示,Transformers 將朝跨框架模型定義標準化發展,目標是讓其支援的模型架構更易被其他生態工具採用。目前 Transformers 支援 300+ 種模型架構,平均每週新增約 3 種;團隊計劃簡化建模程式碼和 API,並加強模組化模型定義。
推薦理由:文章交代 Transformers 希望成為跨框架模型定義的共同基礎,並列出簡化模型貢獻流程、提升訓練與推理工具互通的具體方向。
Kaggle 推出與 Hugging Face 的整合,讓 Hugging Face 模型可在 Kaggle 上被發現並連接至 Notebook 使用。
Hugging Face 為 Inference Endpoints 推出新的 OpenAI Whisper 部署方案,效能較前一版本最高提升 8 倍。
推薦理由:文章比較三款 Whisper 變體與 Transformers 基線的轉錄速度及 WER,呈現 Large V3 接近 8 倍的 RTFx 提升與各款相若的 WER 表現。
OpenAI 推出 HealthBench,這是一項評估醫療 AI 的新基準,透過貼近現實的情境測試模型。HealthBench 吸納 250+ 名醫生的意見,旨在為醫療領域的模型表現與安全性提供共同標準。
OpenAI 擴充領導層,迎來 Fidji Simo。頁面提供 Sam 今日稍早向公司分享的訊息,供讀者閲讀。
OpenAI 在亞洲推出資料駐留,相關安排建基於其支援全球客户的企業級資料私隱、安全及合規計劃。
Mistral AI 推出由 Mistral Medium 3 驅動的 Le Chat Enterprise,將企業搜索、知識整合及自訂 AI 智能體納入同一平台。
推薦理由:Le Chat Enterprise 將企業搜索、知識整合、無代碼智能體建構與多種部署方式整合於同一方案,並交代首批連接器和功能推出節奏。
Mistral AI 發佈 Mistral Medium 3,定位為兼顧效能、成本與企業部署的語言模型。Mistral AI 稱,該模型在各項基準測試中的表現達到 Claude Sonnet 3.7 的 90% 或以上,API 定價為每 M token 輸入 $0.4、輸出 $2;亦可部署於任何雲端,包括使用 4 張或以上 GPU 的自託管環境。
推薦理由:文章將 Mistral Medium 3 與 Claude Sonnet 3.7 的基準表現、API 定價和自託管條件放在一起比較,呈現企業部署時效能、成本與部署方式之間的核心取捨。
聖安東尼奧馬刺隊正運用 ChatGPT 擴大球場內外的影響力。球隊透過自訂 GPTs 提升球迷互動、簡化營運流程,並推動各團隊創新。
Lowe’s 與 OpenAI 合作打造 Mylow 和 Mylow Companion,為顧客及門市員工提供 AI 專家協助。這些工具讓複雜的家居改善項目更易規劃、推進及完成。
OpenAI 推出 OpenAI for Countries,這項新倡議旨在支援全球希望以民主 AI 基礎設施為依託發展的國家。
OpenAI 推出 AI stories,以日常 AI 益處呈現更大機遇。Sam Altman 指出,人類正進入「智能時代」,AI 將大幅提升人的能力,令科學、醫學、教育及國防等當前重大難題變得可解,並開拓新的可能與繁榮。
John Deere 的 Justin Rose 分享公司如何運用 AI 推動農業轉型,並擴大創新規模。這些創新旨在協助農民工作得更聰明、更有效率,並以更可持續的方式工作。
OpenAI 董事會發布架構更新,內容涉及將其營利實體轉型為公益公司(Public Benefit Corporation)。此架構旨在鞏固非營利組織監督下的使命導向,同時促進更大影響力及與公共利益的長期一致性。
推薦理由:這項更新聚焦營利實體轉型與非營利監督之間的安排,呈現 OpenAI 將使命導向架構與長期公共利益目標相連的治理方向。
OpenAI 已在 ChatGPT 撤回上週的 GPT-4o 更新,用户目前改用行為較平衡的早期版本。被撤回的更新過度奉承或迎合,常被形容為 sycophantic。
推薦理由:公告同時交代撤回更新的原因與回退後的版本狀態,呈現 GPT-4o 行為調整對 ChatGPT 用户的直接影響。
Meta 發佈 Llama Guard 4 多模態安全模型,以及兩款用於偵測提示詞注入和越獄的 Llama Prompt Guard 2 分類器,參數量分別為 86M 和 22M。
推薦理由:文章交代 Llama Guard 4 的圖文審核範圍與單張 24 GB VRAM GPU 部署條件,並附 Llama Prompt Guard 2 分類器規格及使用示例。
OpenAI 宣佈其最新圖像生成模型 gpt-image-1 現已可透過 API 使用。開發者與企業可將可自訂的專業級視覺內容直接整合至自有工具與平台。
推薦理由:材料交代 gpt-image-1 已可透過 API 使用,並指出開發者與企業可將可自訂的專業級視覺內容直接整合到自有工具與平台。
Speak 正以 AI 個人化語言學習。文章以對談形式訪問 Speak 行政總裁兼共同創辦人 Connor Zwick。