AI 原生公司如何將工作流程轉化為營運能力
Basis、Clay 和 Exa Labs 運用 AI 智能體改善客户導入、帳户管理及開發者整合,呈現 AI 原生公司如何把工作流程轉化為營運能力。相關做法可供企業領導者參考。
Basis、Clay 和 Exa Labs 運用 AI 智能體改善客户導入、帳户管理及開發者整合,呈現 AI 原生公司如何把工作流程轉化為營運能力。相關做法可供企業領導者參考。
醫療機構現可將 EHR 及其他行業數據連接至 ChatGPT。ChatGPT 可連接可信醫療數據,讓臨牀人員安全存取患者背景、醫學研究等資訊。
Gilbert + Tobin 律師事務所以 CEO 主導的承諾、嚴謹治理及人類問責,將 ChatGPT Enterprise 與 Codex 擴展至全所。內容聚焦於這些做法如何支持 AI 規模化。
Hugging Face 推出 @huggingface/kernels JavaScript loader,並在 Hub 發布首批 207 個 WebGPU kernels。
推薦理由:文章將 207 個 WebGPU kernels 的版本化操作契約、正確性測試與基準案例一併呈現,並提供 Apple M4 上與 ORT WebGPU 的比較數據。
Google Research 發佈 TimesFM-3,一款原生支援多變量零樣本預測的時間序列基礎模型,可在單次前向傳播中預測多條相關序列。它有 330 million parameters,使用超過 1 trillion time points 的真實及合成時間序列資料預訓練,並能結合多個目標、歷史協變量和已知未來協變量,無需任務專用微調。
Microsoft Research 公開 GigaPath-Flash 與 GigaTIME-Flash 兩款開放權重病理基礎模型,以降低大規模病理研究的計算成本。
Polimill 建構日本新一代公共 AI 基礎設施。該公司運用 OpenAI GPT 模型及 Codex,協助地方自治體搜尋和運用行政知識,並加快開發。
OpenAI 支持加州 SB 1119,推進為青少年制定有力且符合年齡特點的 AI 安全保障。相關保障旨在保留青少年學習、創作與探索的機會。
OpenAI 宣佈,ChatGPT Ads 的年化收入運行率達 $1 billion,並擴展至全球。這項業務透過免費及平價選項,支持擴大 AI 的使用機會。
推薦理由:材料將 ChatGPT Ads 的收入規模與全球擴展,連同免費及平價選項支持 AI 普及的方向一併交代,呈現其商業進展與使用入口之間的關聯。
OpenAI 決定在 SpaceX 收購 Cursor 後,逐步結束向 Cursor 提供 OpenAI 模型的合約。
推薦理由:公告交代 Cursor 被 SpaceX 收購後,OpenAI 決定逐步結束向 Cursor 提供 OpenAI 模型的合約,呈現收購後供應合作安排的變動。
OpenAI 與泰國 MHESI 推出為期 8 週的加速器,協助 10 家初創企業將 AI 原型轉化為可信賴產品。參與企業來自健康、身心健康及教育領域。
Voice Arena 與 Hugging Face 為 Open ASR Leaderboard 加入 Monsoon en-IN 和 Monsoon hi-IN 評測集,涵蓋 Indian English 與 Hindi,令 Hindi 成為其多語言分頁首個 Indic language。
推薦理由:這批評測集把説話者背景與可接受的拼寫變體納入 ASR 評估,讓總體 WER 之外的區域差異和 Hindi 正字法誤差更容易被辨識。
Google Earth AI 介紹實驗性行星預測引擎(PPE),可根據自然語言查詢自主完成地理空間資料搜尋、整理、模型訓練與評估。測試中,21 項 CDC 健康指標的平均 R² 為 76.8%,高於人工專家流程的 60.0%;尼日利亞糧食安全由 ADM1 下採樣至 ADM2,R² 為 66.1%,基線為 31.5%。
Google DeepMind 推出 Gemini Omni 1.1 Flash,為影片生成加入場景延伸、首尾幀控制、影片參考輸入及 1080p 或 4K 輸出。
推薦理由:場景延伸可分析最多10秒的既有影片,並以10秒增量延長至累計40秒;配合首尾幀指定,呈現更長影片創作中的控制方式。
一項涉及逾 1,000 名學生的隨機研究,考察 ChatGPT、批判思維訓練、原創性,以及學生完成真實大學作業的表現。
OpenAI 正擴大在巴西的佈局,深化與開發者、企業及社區的互動,以支持 AI 在全國各地的採用。
Google DeepMind 發佈 Gemini 3.5 Transcribe,這是一款面向智能語音互動的語音轉文字模型。它可透過 Live API 以低於一秒的延遲進行即時串流,亦可經 Interactions API 處理預錄音訊,提供説話者歸屬及逐字時間戳。
推薦理由:材料同時提供串流與非串流 WER,以及相較 Chirp 3 的最終轉錄時間改善幅度,讓準確度與延遲兩項表現有具體數據可供對照。
ChatGPT for Teachers 正擴展至 55 個美國學區系統。此擴展將為額外超過 100,000 名教育工作者及職員提供安全 AI 工具、培訓和支援。
OpenAI 的新報告探討學生和教育工作者如何使用 ChatGPT,讓學習更具持續性。ChatGPT 的支援延伸至課堂之外。
loveholidays 使用 OpenAI Codex,讓公司各團隊更容易參與軟件開發。這有助團隊更快把想法轉化為產品。
OpenAI 分享 Hugging Face 安全事件的相關發現,並説明正採取的措施,以加強 AI 模型安全、監察及對齊。
Google Research 提出 AgentHands,將 LLM 回應轉化為與語音同步、能配合 XR 空間場景的手勢。系統透過物件註冊、手勢事件和字級時間戳協調語音播放與動畫;研究以 N = 12 名參與者進行受試者內測試,使用蘭花護理和 3D 打印機操作任務,比較 AgentHands 與純語音基線。
IBM Granite 團隊詳述 Granite 4.2 推理模型系列的構建流程,涵蓋架構、訓練方法及評測結果。該系列有 3B、8B、30B 三種稠密、僅解碼器模型,均由 Granite-4.1 base models 後訓練;後者以約 15T tokens 預訓練,並透過五階段策略將上下文窗口延至 512K tokens。
推薦理由:文中並列三種規模共用的訓練主線,以及 8B、30B 額外加入真實環境 Agentic RL 的分支,可據此理解各規模訓練階段和智能體能力培養的差異。
OpenAI CFO Sarah Friar 闡述晶片、算力、模型與產品的進步如何相互疊加,帶來更實用、規模更大且成本更低的智能。
Jalapeño 是 OpenAI 自研的 AI 推理晶片,首批結果顯示其推理速度與能效領先業界。它為現代模型提供更快、能效更高的 AI 推理,並帶來更高吞吐量與更低延遲。
Gradio 內置的 gr.Workflow 可把 AI 工作流表示為由帶類型節點組成的圖,並提供可拖放、逐節點執行及查看中間結果的畫布。節點可執行 Python 函數、調用 Hugging Face Inference Providers 模型或其他 Gradio Space,也可處理 Hub 數據集資料。
推薦理由:文章以多個可執行示例展示如何把模型、Python 函數與 Gradio Space 串成工作流,並讓節點輸出直接成為 API。
OpenAI 推出供 ChatGPT Work 和 Codex 使用的 Admin plugin,可分析工作區使用情況、管理成員與權限、調整限制,並處理管理員請求。
OpenAI 封禁了來自俄羅斯、利用 AI 宣傳虛構的以色列智庫及「主權」指數的帳户,打擊一場新的隱蔽影響力行動。該指數讚揚俄羅斯並批評西方。
Mistral AI 與 HUMAIN 宣佈戰略合作,將在沙特阿拉伯及區域內推進 AI 基礎設施、先進模型開發和 AI 解決方案部署。雙方將開發並本地化先進 AI 模型,初期聚焦網絡安全和語音,並計劃開發阿拉伯語表現出色的前沿模型;合作規模達數億歐元。Mistral AI 將探討使用 HUMAIN 的數據中心基礎設施,雙方亦計劃在沙特制定面向受監管行業的共同市場策略。
GPT-5.6 現已在 Kiro 中提供,協助開發者以更佳性價比規劃、建構、審查及測試軟件。
Google Research 提出 Mobility-Embedded POIs(ME-POIs)框架,將匿名聚合流動模式融入地點表示,增強語言模型對地點動態功能的理解。在未見地點的測試中,到訪意向預測相對提升最高 81.9%,價格水平分類提升 75.1%,繁忙程度估算準確度提升 24.7%。
Hugging Face 的研究提出三項測試衡量語音辨識中的基準優化,並評估 11 個常用開源 ASR 模型,發現多個模型會重現與音訊不符的基準文本。研究在所分析的 VoxPopuli 測試片段中標記出 40% 的潛在參考文本錯誤,涉及約 3% 的參考詞;呈現基準優化行為的模型在相關測試中有 18–30% 的情況會重現錯誤參考文本。
Hugging Face 以 Inference Endpoints、Jobs 和 Storage Buckets 建立 Papers with Code 混合搜尋系統,為來自 arXiv 和 Daily Papers 的超過 110,000 篇論文維護嵌入向量。
推薦理由:文章拆解離線批次建向量與線上查詢的分工,並説明端點冷啟動時如何回退全文檢索,呈現混合搜尋進入生產環境的工程取捨。
Mistral 推出 Agentic Search,讓模型透過多步檢索搜尋、查看、導覽及核實複雜文件中的資料。在 FinanceBench 金融文件測試中,正確率由 26.7% 升至 86%;OfficeQA Pro 表格密集的多文件問題則由 6.3% 升至 51.9%。
推薦理由:FinanceBench 和 OfficeQA Pro 的基準數據呈現 Agentic Search 相較單次 RAG 的準確率提升,也量化延遲與 token 使用量變化。
OpenAI 推出名為 Intelligence Age 的新博客,探討變革性 AI 如何重塑權力、治理、經濟及個人自由。
Stampli 使用 Codex 和 ChatGPT Work,將推出製作工時縮短 68%,把原需數週的推出製作流程壓縮至數天。當時期限固定,設計資源已投入其他工作。
OpenAI 重申,符合資格的 API 客户可在前沿模型中使用零數據保留安排。OpenAI 亦預告 Private Safety Processing,支援進階 AI 安全而不損害數據私隱。
Replit 透過由 GPT-5.6 Luna 驅動的 Free Mode 擴大軟件創作入口。Free Mode 讓任何人把想法轉化為可運作的軟件,並稱毋須擔心 token 費用。
ChatGPT Ads 正擴展至歐洲 31 個市場。廣告客户可接觸正在探索、比較選項及作出決策的人士。
OpenAI 發起倡議,支持政府機構加強 AI 在國家安全領域的民主監督。倡議透過工具、培訓及專業知識支援政府機構。