LaunchDarkly 的 AI 驅動產品管理之道
LaunchDarkly 首席產品官 Claire Vo 分享 AI 驅動產品管理的做法。對談聚焦產品經理角色的變化、她的「反待辦清單」,以及打造 AI 原生團隊。
LaunchDarkly 首席產品官 Claire Vo 分享 AI 驅動產品管理的做法。對談聚焦產品經理角色的變化、她的「反待辦清單」,以及打造 AI 原生團隊。
OpenAI 宣佈推出 NextGenAI,承諾向領先機構提供 $50M 資金及工具。
Hugging Face 與 JFrog 合作,將 JFrog 掃描器整合至 Hugging Face Hub,以分析模型權重中的程式碼並減少誤報。現有 picklescan 按模組名稱作模式匹配,JFrog 則會解析程式碼、檢查潛在惡意用法,並可捕捉 pickle 與 Keras Lambda layers 的相關利用方式。
推薦理由:JFrog 會解析模型權重中的程式碼,補充 picklescan 以模組名稱作模式匹配的檢查方式,並讓公開模型倉庫自動納入掃描。
Cohere For AI 發佈 Aya Vision 8B 和 32B,這組開放權重視覺語言模型支援 23 種語言。Aya Vision 32B 在 mWildVision 的 23 種語言平均比較中,對參數量超過其 2 倍的模型取得 52% 至 72% 勝率。團隊亦公開 AyaVisionBench,涵蓋 23 種語言、9 類任務,每種語言有 135 組圖像與問題配對,供研究使用。
推薦理由:文章拆解合成標註、多語言資料擴充與多模態模型合併等訓練做法,呈現 Aya Vision 的多語言視覺語言建模路徑。
OpenAI 與 9 個國家實驗室舉辦首個同類型 AI Jam Session,聚集 1,000 名頂尖科學家。
Mercari 運用 GPT-4o mini 和 GPT-4 簡化賣家銷售流程、改善商品刊登並提升銷售。其線上市集功能包括 AI Listing Support 和 Mercari AI Assistant,為賣家提供支援並推動平台轉型。
OpenAI 宣佈推出 GPT-4.5 的研究預覽版,並稱其為目前規模最大、知識最豐富的模型。原文標題為 OpenAI GPT-4.5 System Card。
OpenAI 的 deep research 系統卡概述產品推出前完成的安全工作。這些工作包括外部紅隊測試、依據 Preparedness Framework 進行的前沿風險評估,以及針對主要風險領域內置的緩解措施。
Hugging Face 推出 FastRTC,這是一個讓開發者以 Python 建構即時音訊與影片 AI 應用的通訊程式庫。它內置語音偵測與輪次控制,提供支援 WebRTC 的 Gradio UI,並可將 Stream 掛載至 FastAPI 應用;亦支援 WebSocket。程式庫另提供語音轉文字、文字轉語音等工具,並可接駁不同 LLM、語音 API 或語音到語音模型。
推薦理由:FastRTC 將語音偵測、輪次控制和即時通訊整合起來,並提供 Gradio 測試介面及 FastAPI 部署方式,展示以 Python 搭建即時語音應用的實作流程。
Google 發佈 SigLIP 2 多語言視覺語言編碼器系列,加入新的訓練目標以提升語義理解、定位及密集特徵表現。訓練加入圖像描述與區域定位解碼器、自蒸餾的 Global-Local Loss 和 Masked Prediction Loss,並提供動態解析度 naflex 版本。
推薦理由:SigLIP 2 把解碼器監督、自蒸餾與遮罩預測納入訓練,並提供動態解析度版本,展示提升局部語義表徵與適應不同長寬比的訓練思路。
Uber 以 AI 提供出色的按需體驗。內容是與 Uber 客户至上部門 AI 與產品主管 Jai Malkani 的對談。
Hugging Face 發佈 SmolVLM2,提供 2.2B、500M 和 256M 三種影片理解模型,並從推出首日起支援 Transformers 和 MLX,後者提供 Python 及 Swift API。
推薦理由:文章同時列出 2.2B、500M、256M 規模及 Video-MME 表現,方便比較不同參數量下的影片理解能力取捨。
Google 發佈 PaliGemma 2 Mix,這組視覺語言模型是在 OCR、長短圖像描述等任務上微調的 PaliGemma 2 版本。模型提供 3B、10B、28B 三種規模,以及 224 和 448 兩種解析度。模型涵蓋視覺問答、文件理解、圖中文字辨識和物件定位;物件偵測與圖像分割需使用任務前綴,其餘任務使用開放式提示詞表現較佳。
OpenAI 推出 SWE-Lancer 基準測試,探問前沿 LLM 能否透過真實世界的自由接案軟件工程工作賺取 $1 million。
Hugging Face Hub 新增 Hyperbolic、Nebius AI Studio 和 Novita 三家無伺服器推理服務商,並將它們接入模型頁面及 JavaScript、Python 客户端 SDK。
Mistral 推出 24B 參數的區域語言模型 Mistral Saba,支援阿拉伯語及多種印度源語言,並在 Tamil 等南印度源語言上表現尤佳。Mistral 稱,Mistral Saba 的回答比規模超過其 5 倍的模型更準確、相關,且速度更快、成本更低。它可透過 API 使用,也可在客户安全環境內本地部署,並能在單 GPU 系統上以每秒超過 150 tokens 的速度回應。
OpenAI 與 Guardian Media Group 宣佈建立內容合作夥伴關係。合作將 Guardian 新聞內容帶入 ChatGPT。
Hugging Face Hub 新增 Fireworks.ai 推理服務支援,用户可在模型頁面及 HF 工具與函式庫中使用無伺服器推理。
Fanatics Betting and Gaming 運用 AI 聚焦全局。OpenAI News 與該公司財務總監 Andrea Ellis 對談。
Wayfair 正以 AI 塑造零售業未來。內容聚焦與 Wayfair 首席技術官 Fiona Tan 的對談。
Rogo 利用 OpenAI o1 擴展 AI 驅動的金融研究規模。
這項基準測試比較文字分類、文本嵌入及視覺嵌入的推理配置,估算處理 1B 筆輸入的成本與延遲。在 nvidia-L4($0.8/hr)上,三類任務每 1B 筆輸入的成本分別為 $253.82、$409.44 和 $44,496.51;測試程式碼見 https://github.com/datavistics/encoder-analysis。
推薦理由:三類實測呈現 GPU、batch size 與並行 VUs 對成本和延遲的影響,並提供可替換模型與硬件重跑的流程,供讀者估算自有配置處理 1B 筆輸入的開支。
Hugging Face Blog 的 hlky 和 Sayak 介紹一套建立影片生成模型微調資料集的三階段工具流程,讓社羣能自行製作小型資料集。流程以 yt-dlp 下載影片、用 Video to Scenes 切成短片,再以影格或全片指標篩選,並用 Florence-2 生成字幕、辨識物件及進行 OCR;也可用 Qwen2.5 為整段影片加字幕。
OpenAI 與 Schibsted Media Group 宣佈內容合作,將 Guardian 的新聞及檔案內容帶入 ChatGPT,讓 ChatGPT 提供相關內容。
Open Arabic LLM Leaderboard 2 更新阿拉伯語大語言模型評測基準,移除飽和及機器翻譯任務,採用原生阿拉伯語或人工翻譯基準。
OpenAI 首次在超級碗期間播放電視廣告,藉此引發公眾對 AI 新可能性的好奇。廣告希望人們認識到,AI 能像過往工具一樣,為生活帶來更多滿足感並提升生產力。
Mistral AI 推出全新 le Chat AI 助手,面向生活與工作場景,並開始提供 iOS、Android 版本及 Pro、Team 方案。它支援網頁搜尋、文件上傳與摘要、圖像生成及沙盒程式碼執行;Flash Answers 預覽版向所有用户開放,速度最高可達 ~1000 words / sec。
推薦理由:le Chat 整合文件分析、Code interpreter、圖像生成與日常助理用途,並以免費、Pro、Team及企業私有部署方案覆蓋不同場景。
OpenAI 在歐洲推出數據駐留;此安排建基於其支援全球客户的企業級數據私隱、安全及合規計劃。
OpenAI 與 CSU 系統將把 ChatGPT 部署至 500,000 名學生及教職員,這是迄今最大規模的 ChatGPT 部署。此部署將擴大 AI 在教育中的應用,並協助美國培養具備 AI 能力的勞動力。
推薦理由:原文把這項涵蓋 500,000 人的部署,與擴大教育中的 AI 應用及培養具備 AI 能力的勞動力相連。
以 ChatGPT 打造自訂數學導師,聚焦 ChatGPT 與個人化輔導;正文未提供設計流程、具體功能或其他規格。
Hugging Face 與 Adyen 聯合推出 DABstep,這項基準以450多項數據分析任務評估 AI 智能體的多步推理能力。任務源自 Adyen 的實際工作負載,但資料與商業背景為人工生成;基準涵蓋結構化資料和非結構化文件,並提供資料集、任務、評測、即時排行榜及基線。
ChatGPT 可用於尋找美甲靈感。
ChatGPT 被用於捕捉大比目魚;原文未提供具體方法或捕捉結果。
OpenAI deep research 協助 Bain & Company 理解複雜行業趨勢。
OpenAI 推出 deep research,這個智能體會運用推理整合大量網上資訊,並替用户完成多步驟研究任務。功能現時向 Pro 用户開放,Plus 和 Team 用户隨後可用。
推薦理由:公告交代 deep research 如何處理網上資訊整合與多步驟研究任務,並列出 Pro、Plus、Team 的開放次序,方便了解其適用工作場景。
OpenAI 封禁了與伊朗有關、利用 AI 生成文章和社交貼文的帳户,相關內容涉及 IUVM 和 STORM-2035 影響行動。相關活動橫跨多個平台。
OpenAI 封禁了一批看似源自柬埔寨、使用 AI 翻譯及生成戀愛與投資詐騙對話的帳户。標題將相關流程描述為 AI 輔助的殺豬盤詐騙。
OpenAI 封禁了一批利用 AI 為加納 2024 年總統選舉生成文章、貼文及虛假互動的帳户。
OpenAI 封禁了可能與公開報道所指的北韓相關威脅行為者有關聯的賬户。這些威脅行為者使用 AI 研究入侵工具、網絡釣魚、惡意軟件,以及以加密貨幣為目標的活動。
OpenAI 封禁了可能被用於協助 AI 輔助招聘欺詐的帳户。相關欺騙性就業計劃具有公開報道的朝鮮關聯 IT 工作者活動特徵。