在 Amazon SageMaker Studio 直接管理 Amazon SageMaker HyperPod Spaces
Amazon SageMaker Studio 現可直接在 HyperPod EKS 叢集建立及管理 Amazon SageMaker Spaces,並啟動 JupyterLab 或 Code Editor。
Amazon SageMaker Studio 現可直接在 HyperPod EKS 叢集建立及管理 Amazon SageMaker Spaces,並啟動 JupyterLab 或 Code Editor。
Amazon SageMaker AI 推出 aws-ai-ml 技能,讓支援 MCP 的編碼智能體協助最佳化生成式 AI 推理。它可測試現有端點、推薦部署配置、比較基準測試結果,並生成可檢視及執行的 SageMaker Python SDK v3 程式碼;測試報告提供實際基礎設施負載下的吞吐量、延遲和並行數據。
GitHub 推出 ReviewBench,作為評測 AI 程式碼審查智能體的離線基準,研究預覽版已可透過網站使用。
推薦理由:ReviewBench以219個跨19種語言的公開PR建立評測集,並公開多來源標註與評分方法;資深工程師判斷與基準的一致率為96.6%。
OpenAI 在 ChatGPT 推出新視覺廣告格式。公司亦擴展面向廣告商的測量工具、歸因合作及品牌適配。
NVIDIA 宣佈 DGX Spark 64GB 配置將於 10 月 23 日由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 開售,起價 $4,999。
Amazon Quick 推出 Live Data in Apps,讓已發布的 Quick Apps 每次開啟時即時查詢受治理的 Quick Sight 資料集,而非讀取建置時快照。查詢以查看者身份執行並套用其 RLS 與 CLS 權限;每位查看者首次使用每個資料集時須同意,且不支援匿名或公開存取。
Google DeepMind 推出 SynthID Bio,將可檢測水印嵌入蛋白質序列和預測結構,以辨識 AI 生成的生物設計。
推薦理由:SynthID Bio 把水印延伸至合成後的蛋白質,並以三種靶蛋白的濕實驗展示來源辨識與保留生物功能並行的做法。
CoreWeave 宣佈在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72,並推出 CoreWeave Forge,推進智能體 AI 從訓練到生產的部署。
推薦理由:文章披露 Cognition 對 Vera Rubin NVL72 與 GB200 NVL72 的 SWE-2 推理測試,列出最高 4.8x 的總 token 吞吐提升,讓兩種平台在智能體編碼工作負載下可作量化比較。
Amazon Bedrock 現已在印度提供 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,透過印度地理跨區域推理處理請求。
Amazon Bedrock 現已在首爾支援 Claude Opus 5 和 Claude Sonnet 5 的區域內推理,並在新加坡支援 Claude Sonnet 5。
Hugging Face 建立 Open TTS Leaderboard,以客觀指標評估開源、多語言 TTS 模型及聲音複製能力。評估涵蓋 WER/CER、批次推理速度(RTFx)、首段音訊延遲(TTFA)及説話者相似度(SIM),可把單個模型的評估時間由數週縮短至數小時。排行榜不取代人工偏好評選,並設有 Listen 頁籤供用户比較生成音訊及投票;其指標不直接衡量自然度、表現力或聽者偏好。
推薦理由:排行榜以客觀指標並列呈現語音清晰度、説話者相似度與速度表現,並保留聆聽投票,方便比較多語言及聲音複製模型。
Microsoft Research 介紹 Quine,一個結合生物學多模態世界模型與互動式研究流程的 AI 研究系統,並開放首屆 Quine Fellows 計劃申請。
推薦理由:Quine 將跨生物模態的世界模型接入文獻、科研工具與實驗迴圈,並以胰臟癌細胞狀態轉換案例展示預測如何進入濕實驗驗證。
OpenAI DevDay 2026 回顧超過 20 項公告,內容涵蓋 GPT-6 Astra、ChatGPT、Codex、API、安全,以及面向開發者的新工具。
OpenAI 推出 dots,這些主動式助理能在複雜項目與日常任務中持續工作。dots 協助使用者在工作推進期間保持掌控。
OpenAI 正為 Codex Originals 計劃徵集 Codex 使用者的真實故事。徵集對象包括開發者、創客、研究人員及創作者;有意參與計劃下一階段者可分享自己的故事與項目。
Hugging Face Hub 新增 RL Environments 篩選入口,集中展示帶有 rl-environment 標籤的資料集。資料集可標示 Harbor、Verifiers、OpenEnv、NeMo Gym 的兼容性,並在頁面提供相應的執行命令。標籤只描述兼容性,不會把檔案轉換成其他框架格式,也不會啟動 job 或 sandbox。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,將近乎即時視像生成與語音結合,讓企業智能體以動態虛擬形象進行多模態對話。
Microsoft 宣佈 Physical AI Toolchain 新增機械人推理卸載功能,支援透過 Kubernetes 工具把 AI 工作負載分配至機械人、邊緣 GPU 和雲端。
推薦理由:文章將實機工作負載的效能、電池續航與算力配置放在同一脈絡比較,並介紹以 Kubernetes 分配推理的工具,呈現卸載方案的收益與代價。
Google DeepMind 推出 Gemini 3.8 Flash TTS 與 Gemini 3.8 Flash-Lite TTS,支援自訂聲線、逐句控制表演及雙人對話生成。
推薦理由:兩款 TTS 模型涵蓋逐句演繹與長篇生成,Flash TTS 另可自訂聲線;聲音複製設有同意驗證,生成音訊加入 SynthID 水印,呈現創作控制與防護安排。
Harvey 透過 GPT-6 Astra 產出結構更清晰、能顧及上下文的法律文件草稿,讓律師可把精力集中於策略工作。
ChatGPT Ads 正擴展至東南亞及台灣。這項擴展讓符合資格的企業能透過新途徑觸及超過 60 個國家的受眾。
GPT-6 改進提示詞快取,提升快取命中率,並加入新診斷功能、明確斷點,以及可降低延遲和成本的控制項。
NVIDIA 發佈 Isaac ROS 5.0,加入讓開發者與 AI 智能體協作構建機械人的工作流,並支援 ROS Lyrical 和 Ubuntu 24.04。
推薦理由:Isaac ROS 5.0 把智能體工作流、可重用技能和平台支援納入開源機械人開發,呈現開發工具銜接 Jetson 部署的實作路徑。
Hugging Face 為 Transformers 加入 GGUF 支援,讓用户可透過熟悉的 Transformers API 在本機載入量化檢查點並生成內容。
推薦理由:文章示範透過 Transformers API 從 Hub 載入 GGUF 量化檢查點,並以 Q4_K_M 等選項説明檔案大小與精度的取捨。
Higgsfield AI 藉助 GPT-6 Astra 在一天內推出新影片功能,讓小型企業更容易製作影片廣告。這亦令 Higgsfield AI 能更快將新創作工具推向市場。
OpenAI Academy 擴增面向員工、開發者、領導者、教育工作者及學生的全新學習路徑,協助他們培養並展示實用 AI 技能。
Cooley 使用 ChatGPT Work 建立 GO Public,為 IPO 流程引入智能支援。該工具協助律師提早發現問題,並把專業判斷集中於最重要之處。
OpenAI 探索以 AI 驅動的全新廣告體驗,涵蓋 Sponsored Agents、面向營銷人員的工具,以及與 HubSpot 和 Shopify 的整合。
GPT-6 Astra 協助 Hex 的資料智能體將答案轉化為互動式視覺化內容,令員工引以為傲並樂於分享。
ChatGPT Work 與 Codex analytics 協助團隊瞭解 AI 使用情況及開支,並將採用情況連結至業務成果。團隊亦可藉此辨識培訓需求。
Cognition 藉助 GPT‑6 Astra 提升 Devin 測試軟件並驗證其可正常運作的能力。目標是讓工程師減少審閲程式碼,並交付更多成果。
OpenAI 在 ChatGPT Work 推出 Data agent,支援連接公司數據、發掘洞察,並透過自然語言以 AI 建立互動式儀錶板。
OpenAI 推出 ChatGPT for Financial Services,結合內置金融數據與 GPT-6 Astra,用於研究、建模及製作面向客户的材料。
OpenAI 推出 Agents API,這項由 Codex harness 驅動的託管服務可用於建置及啟動雲端智能體。服務支援編排、長時段工作階段與工具使用。詳情見 https://openai.com/index/introducing-the-agents-api。
推薦理由:這則公告交代 Agents API 將編排、長時段工作階段與工具使用納入雲端智能體託管服務,清楚界定其運作範圍。
Google DeepMind 推出 AlphaGenome Atlas,提供人類基因組 9 billion 個單核苷酸變異的分子效應預測。平台整合 AlphaGenome 與 AlphaMissense 的預測,推出 AVI 分數,協助研究者排序變異並解讀分子效應,涵蓋編碼及非編碼區域。
推薦理由:UK Biobank 案例顯示,按預測分子效應聚合罕見變異,研究者在逾 54,000 名參與者資料中多找出 22% 的非編碼區域遺傳關聯。
OpenAI 推出 ChatGPT Images 2.5,可把使用者的想法、草圖和參考相片轉化為更個人化、精緻,且更能反映其構想的圖像。
GitHub 推出 Project HydraFusion 研究預覽,以執行時多模型編排為編碼任務動態規劃模型工作流程。它會從不同供應商的模型中選擇 Single、Cascade 或 Critique 工作流程;所有 GitHub Copilot 方案用户可在 Copilot CLI 執行 `/experimental`,再執行 `/model` 選用 HydraFusion。
推薦理由:三項離線編碼基準呈現 HydraFusion 不同的品質與成本取捨,與 Claude Opus 5 的對照能幫助理解多模型編排在不同任務上的效益差異。
Hugging Face 推出開源工具 funes,讓 Claude Code、Codex、pi 和 Hermes 共用可檢索的持久記憶。funes 預設在本機索引、嵌入及重排工作記錄,檢索時返回原文並標示智能體、時間戳、工作階段和回合;記憶亦可發布至預設私有的 Hugging Face 資料集,供其他機器使用。
推薦理由:funes 將不同編碼智能體的工作記錄轉為本機可檢索記憶,並保留原始片段及來源脈絡,展示跨會話延續決策依據的實作方式。
Google DeepMind 推出有限度開放的 Fairwind Program,讓政府機構及可信賴夥伴使用進階 AI 網絡防禦能力。計劃把 Gemini 3.8 Flash Cyber 與 CodeMender 結合,用於自主發現、驗證及修復漏洞,並可在機構安全雲端環境內於數分鐘生成經驗證、可部署的修補程式。
推薦理由:Fairwind 將 Gemini 3.8 Flash Cyber 與 CodeMender 結合,讓參與機構在安全雲端環境內生成經驗證、可部署的漏洞修補程式,將人工修補由數週縮至數分鐘。
Google DeepMind 推出 Gemini 智能體影片理解功能,影片分析成本最多降低 66%、token 用量最多降低 88%,準確度最多提升 7%。
推薦理由:相較固定 FPS 靜態處理,Gemini 會動態檢視畫面、音訊與字幕,影片分析的 token 用量最多減少 88%、成本最多減少 66%。