NVIDIA 發佈 Isaac ROS 5.0,加入智能體工作流並支援 ROS Lyrical
NVIDIA 發佈 Isaac ROS 5.0,加入讓開發者與 AI 智能體協作構建機械人的工作流,並支援 ROS Lyrical 和 Ubuntu 24.04。
推薦理由:Isaac ROS 5.0 把智能體工作流、可重用技能和平台支援納入開源機械人開發,呈現開發工具銜接 Jetson 部署的實作路徑。
NVIDIA 發佈 Isaac ROS 5.0,加入讓開發者與 AI 智能體協作構建機械人的工作流,並支援 ROS Lyrical 和 Ubuntu 24.04。
推薦理由:Isaac ROS 5.0 把智能體工作流、可重用技能和平台支援納入開源機械人開發,呈現開發工具銜接 Jetson 部署的實作路徑。
vllm-metal 把 vLLM 的排程器、分頁 KV cache 和 OpenAI 相容伺服器帶到 Apple Silicon,並以 MLX 和 Metal 執行模型。
OpenClaw 正加入可選的決策模型支援,讓平台支援的功能及插件使用另行設定的模型,且不會取代對話模型。Plugin SDK 提供共用 API `api.runtime.decisions.evaluate`;TypeSafe adapter 支援託管版 Jev 及本地 System One 伺服器,例如 Kev。
Together AI 介紹端點 Rollouts 功能,讓用戶以 canary、blue-green 或 rolling 策略,將生產流量由來源部署切換至目標部署。
Hugging Face 為 Transformers 加入 GGUF 支援,讓用户可透過熟悉的 Transformers API 在本機載入量化檢查點並生成內容。
推薦理由:文章示範透過 Transformers API 從 Hub 載入 GGUF 量化檢查點,並以 Q4_K_M 等選項説明檔案大小與精度的取捨。
Higgsfield AI 藉助 GPT-6 Astra 在一天內推出新影片功能,讓小型企業更容易製作影片廣告。這亦令 Higgsfield AI 能更快將新創作工具推向市場。
OpenAI Academy 擴增面向員工、開發者、領導者、教育工作者及學生的全新學習路徑,協助他們培養並展示實用 AI 技能。
vLLM 整合 PyNvVideoCodec,支援使用 NVIDIA GPU 解碼影片,將影片解碼工作從 CPU 移走,以擴展多 GPU 影片字幕生成吞吐量。在 8 張 H100 的測試中,GPU 解碼吞吐量比 CPU 解碼高逾一倍,且大型負載的 CPU 瓶頸消除。PyNvVideoCodec 已包含於標準 CUDA 版 vLLM;自訂安裝需加入 PyNvVideoCodec==2.0.4。
OpenClaw 推出原子更新機制,準備更新時會維持現有 gateway 運作,更新失敗則回復至上一個可用設定,並保留可協助診斷問題的 Agent。同時,OpenClaw 推出更新問題回報按鈕。Jason Sy 表示新流程在不少情況下有效,但尚未稱更新問題已完全解決。
Cooley 使用 ChatGPT Work 建立 GO Public,為 IPO 流程引入智能支援。該工具協助律師提早發現問題,並把專業判斷集中於最重要之處。
Midjourney 更新 Alpha 網站,改善 v8.2 編輯器、手機和平板版面、提示詞欄及圖片整理功能。v8.2 編輯器在附加圖片時會詢問用戶想修改甚麼,草稿批次可在網格中預覽來源圖片並使用 Enhance;手機和平板版亦改善版面及上載刪除操作。團隊下一步計劃設定預設參數、以提示詞預覽 sref,並在用戶開啟圖片再返回時保留搜尋內容。
Sakana AI 更新 Sakana Chat(https://chat.sakana.ai/),向所有用戶開放 Fugu Max,並新增可將會話內容帶入後續對話的記憶功能。Fugu Max 會按提示詞將處理分配給合適的開源模型;官方稱其性能可媲美前沿模型,且不依賴單一模型。記憶功能適用於 Namazu 和 Fugu Max,可在設定中查看或關閉;只記錄本次更新後的對話。
OpenAI 探索以 AI 驅動的全新廣告體驗,涵蓋 Sponsored Agents、面向營銷人員的工具,以及與 HubSpot 和 Shopify 的整合。
GPT-6 Astra 協助 Hex 的資料智能體將答案轉化為互動式視覺化內容,令員工引以為傲並樂於分享。
ChatGPT Work 與 Codex analytics 協助團隊瞭解 AI 使用情況及開支,並將採用情況連結至業務成果。團隊亦可藉此辨識培訓需求。
OpenClaw 推出安全資訊頁,集中呈現目前安全狀態、安全公告、持續工作、研究及漏洞回報指引。自 1 月以來,項目已發布 722 項修復;14 宗回報涉及經確認的嚴重漏洞,全部已修復並披露。OpenClaw 亦公開包含超過 67,000 次 ClawHub 技能掃描的數據集,並列出掃描技能、阻止安裝惡意或已隔離技能等持續工作。
Epoch AI 將 AI Data Centers explorer 擴至 86 個數據中心,估計涵蓋全球 AI 算力的 44%,並重新設計頁面。各站點資料包括以 H100-equivalents 計的算力容量、晶片類型、資本成本、建設狀態及衞星影像。
Sakana AI 為 Sakana Marlin 新增 Interactive Reading 和可編輯 PowerPoint 投影片匯出,讓用戶查核報告依據並編修調查結果。
Cognition 藉助 GPT‑6 Astra 提升 Devin 測試軟件並驗證其可正常運作的能力。目標是讓工程師減少審閲程式碼,並交付更多成果。
Together AI 擴展 Together Fine-Tuning,加入更多開放權重模型、即時實驗追蹤及更精細的訓練和數據處理控制,並下調多數支援模型的訓練價格。
OpenAI 在 ChatGPT Work 推出 Data agent,支援連接公司數據、發掘洞察,並透過自然語言以 AI 建立互動式儀錶板。
Cursor 推出 Projects,現正以 beta 階段逐步向所有用户開放,讓協調智能體承接跨月工作並委派子智能體。Projects 預設在雲端運行,需要時可切換至本地,並透過共享上下文及監聽 Slack 頻道、按計劃運行或跟進 PR 來主動處理工作。Cursor 表示,新用户合併 PR 數量提升 30%,而主要使用 Projects 的用户合併量達原來六倍。
推薦理由:Projects 將長週期工作的上下文累積、智能體委派和事件觸發整合起來,文中亦提供新用户與主要使用者的 PR 合併量數據。
OpenAI 推出 ChatGPT for Financial Services,結合內置金融數據與 GPT-6 Astra,用於研究、建模及製作面向客户的材料。
Together AI 推出 Together GPU Clusters 可搶佔運算公開預覽,適用於所有地區的 Kubernetes 叢集,固定按隨需費率 50% 計費。
OpenAI 推出 Agents API,這項由 Codex harness 驅動的託管服務可用於建置及啟動雲端智能體。服務支援編排、長時段工作階段與工具使用。詳情見 https://openai.com/index/introducing-the-agents-api。
推薦理由:這則公告交代 Agents API 將編排、長時段工作階段與工具使用納入雲端智能體託管服務,清楚界定其運作範圍。
OpenAI 將 GPT‑Live‑1 引入 API,提供自然的全雙工語音對話及更強的指令遵循能力。它亦支援自訂聲音及電話服務。
推薦理由:原文列出全雙工對話、指令遵循、自訂聲音及電話支援,能讓讀者迅速掌握 GPT‑Live‑1 接入 API 後涵蓋的語音能力。
Factory 現已上架 Claude Marketplace,企業客戶可將對 Anthropic 的承諾支出用於 Factory。Factory 自動化軟件開發生命週期,為工程團隊提供自我改進系統,涵蓋規劃、實施、測試及安全等工作,並支援多種企業部署模式。
Google DeepMind 推出 AlphaGenome Atlas,提供人類基因組 9 billion 個單核苷酸變異的分子效應預測。平台整合 AlphaGenome 與 AlphaMissense 的預測,推出 AVI 分數,協助研究者排序變異並解讀分子效應,涵蓋編碼及非編碼區域。
推薦理由:UK Biobank 案例顯示,按預測分子效應聚合罕見變異,研究者在逾 54,000 名參與者資料中多找出 22% 的非編碼區域遺傳關聯。
OpenAI 推出 ChatGPT Images 2.5,可把使用者的想法、草圖和參考相片轉化為更個人化、精緻,且更能反映其構想的圖像。
1Password 的工程師使用 Codex 快速開發新功能和內部工具,工程生產力提升 21%。這些成果在維持嚴格安全政策的同時,已達到可投入生產環境的準備狀態。
GitHub 推出 Project HydraFusion 研究預覽,以執行時多模型編排為編碼任務動態規劃模型工作流程。它會從不同供應商的模型中選擇 Single、Cascade 或 Critique 工作流程;所有 GitHub Copilot 方案用户可在 Copilot CLI 執行 `/experimental`,再執行 `/model` 選用 HydraFusion。
推薦理由:三項離線編碼基準呈現 HydraFusion 不同的品質與成本取捨,與 Claude Opus 5 的對照能幫助理解多模型編排在不同任務上的效益差異。
Midjourney 正徵集意見和建議,以瞭解接下來應優先處理及推進哪些工作。平台表示,將於未來一至兩週舉行正式投票。
Midjourney Alpha 加入 v8.2 編輯模型,並在 lightbox 內置新編輯器。用戶可在 lightbox 開啟圖片,以文字指令編輯、附加最多 4 張參考圖片,並集中查看同一工作階段的所有編輯。更新亦修正多項錯誤,並開始測試 lightbox 的 Change Style 功能。
OpenClaw 推出 macOS 安裝程式,並簡化配備 NVIDIA RTX 的 Windows 電腦本地模型設定。macOS 版可偵測並驗證既有 AI 連線;Windows 版可在引導期間偵測 NVIDIA RTX GPU,並為記憶體至少 24GB 的 GPU 建議經硬件調校的本地模型,足以在本機運行 30B 級模型。
Hugging Face 推出開源工具 funes,讓 Claude Code、Codex、pi 和 Hermes 共用可檢索的持久記憶。funes 預設在本機索引、嵌入及重排工作記錄,檢索時返回原文並標示智能體、時間戳、工作階段和回合;記憶亦可發布至預設私有的 Hugging Face 資料集,供其他機器使用。
推薦理由:funes 將不同編碼智能體的工作記錄轉為本機可檢索記憶,並保留原始片段及來源脈絡,展示跨會話延續決策依據的實作方式。
Google DeepMind 推出有限度開放的 Fairwind Program,讓政府機構及可信賴夥伴使用進階 AI 網絡防禦能力。計劃把 Gemini 3.8 Flash Cyber 與 CodeMender 結合,用於自主發現、驗證及修復漏洞,並可在機構安全雲端環境內於數分鐘生成經驗證、可部署的修補程式。
推薦理由:Fairwind 將 Gemini 3.8 Flash Cyber 與 CodeMender 結合,讓參與機構在安全雲端環境內生成經驗證、可部署的漏洞修補程式,將人工修補由數週縮至數分鐘。
Cursor 推出自託管機器功能,讓雲端智能體的工具執行可轉移至團隊自有網絡內的機器,而智能體的推理與規劃仍由 Cursor 雲端負責。團隊可用單機或資源池接入自有基礎設施,資源池會按排隊請求自動擴縮,並可透過快照讓閒置機器休眠及恢復。
Nokia 核心網部門表示,兩名工程師藉助 Cursor 在兩週內分析某條產品線超過 5000 萬行程式碼,無需自訂工具。分析為拆解單體架構、轉向分散式服務架構提供規劃依據,並據 Nokia 估算,數月內釋放十多名專家投入其他項目。Cursor 亦協助 Nokia 將新功能部署工作流約 80% 自動化及可視化,並把根因分析由數週縮短至數天。
Google DeepMind 推出 Gemini 智能體影片理解功能,影片分析成本最多降低 66%、token 用量最多降低 88%,準確度最多提升 7%。
推薦理由:相較固定 FPS 靜態處理,Gemini 會動態檢視畫面、音訊與字幕,影片分析的 token 用量最多減少 88%、成本最多減少 66%。
醫療機構現可將 EHR 及其他行業數據連接至 ChatGPT。ChatGPT 可連接可信醫療數據,讓臨牀人員安全存取患者背景、醫學研究等資訊。