LlamaIndex 7-15-26 電子報整理多項產品更新
LlamaIndex 在 7-15-26 電子報公佈多項產品更新,涵蓋抽取、Markdown 輸出、表格處理和方案席位。Conversational Extract 可透過對話建立抽取 schema,fast tier 預設輸出 Markdown,Agentic Plus 的表格處理有所改善,所有方案(包括免費方案)均支援 100 位使用者。
LlamaIndex 在 7-15-26 電子報公佈多項產品更新,涵蓋抽取、Markdown 輸出、表格處理和方案席位。Conversational Extract 可透過對話建立抽取 schema,fast tier 預設輸出 Markdown,Agentic Plus 的表格處理有所改善,所有方案(包括免費方案)均支援 100 位使用者。
LlamaIndex 的 Parse Gateway 按頁面複雜度將文件分流至 LiteParse 或相應的 LlamaParse 層級,而非整份文件使用同一解析器。
Google 開源 Credentio C++ 庫,用於驗證 C2PA Content Credentials,起步支援規格版本 2.2 和 2.4。其 API 可在開發者應用程式本地執行驗證,媒體檔案毋須傳送至雲端或外部驗證端點;驗證大型檔案時,Credentio 使用的記憶體亦少於其他方案。
LlamaIndex 與 Kaggle 推出 ExtractBench,一個用於評估企業文件結構化資料抽取系統的開放基準。基準涵蓋 370 份企業文件(4,869 頁)、8 個業務領域及 67 種文件類型,評估 14 套系統的準確度、感知質素、表格結構、文件長度及成本。
LlamaIndex 在 LlamaParse Platform 推出 Turbo Beta 文件抽取層,面向低延遲的即時工作流。在 ExtractBench 上,Turbo 比 Cost Effective 快約 4 倍,單頁中位處理時間為 3.7 秒,F1 為 0.84;它直接從文件頁面抽取內容並行處理,中、長文件約為每頁 0.5 秒。
Google 宣佈 ADK for Kotlin 1.0 正式推出,為 Kotlin、Android 及伺服器端開發提供 AI 智能體工具包。版本功能與 ADK 1.0 Core 完整對齊,涵蓋多智能體協調、上下文壓縮、多輪對話、人工確認和工作階段恢復。
LlamaIndex 更新 LiteParse,PDFium 優化令文字抽取耗時減少 20-25%,並改善 Markdown 解析表現,新增視覺定位及 is-complex API。
LlamaIndex 發佈文件抽取智能體 Extract v2.5,提升所有檔位的準確度,且每頁收費不變。ExtractBench 上,Cost Effective 的整體 value F1 由 87.1 升至 93.9,Agentic 由 89.8 升至 95.8,Agentic Plus 由 95.1 升至 96.4。
MemoMind One 將於明日進駐全國 56 家線下門店及 INNO100 全球創新旗艦店,並開放定金預訂。10 月 3 日至 10 月 14 日到店預付 100 元定金,可獲贈價值 199 元墨鏡夾片 1 副。官方稱眼鏡具備 AI 記憶、導航和提詞功能,結合極米顯示、蔡司光學與哈曼聲學,目前尚未公佈配置資訊。
大眾安徽與眾 09 夏測實車亮相,並已開啟預售,售價 19.99 萬元起。新車搭載端到端智能輔助駕駛模型,可實現高速/城區 NOA 和車位到車位 AI 代駕,並標配圖靈 AI 晶片,總算力 750TOPS。
鈦度推出輕鸞 2 頭戴式耳機,售價 159.9 元,主打輕量化機身。耳機重約 230g,搭載 50mm 發聲單元,支援 7.1 遊戲音效與音樂雙模式,並提供 2.4G、藍牙 6.0 及有線 USB 連接。產品內置 1000mAh 電池,配備可插拔全指向 AI 降噪麥克風。
NVIDIA 推出 DGX Spark 64GB 版本,起售價 4,999 美元,並將於 10 月 23 日發售。產品基於 GB10 Grace-Blackwell,約 56GB 記憶體可供模型權重與 KV cache 使用,並最多支援 4 台設備組成集羣。官方實測兩台設備組成集羣運行 Qwen3.8-27B,相比單台設備性能最高提升 1.7 倍。
Meta 宣佈,旗下 AI 智能體 Muse 將於近期登陸智能眼鏡,用户可透過語音指令讓它在後台代辦任務。Muse 基於 Muse Spark AI 模型運行,使用持續運作的雲端 Linux 虛擬機,並可自行編寫、執行程式碼或把工作分派給多個子智能體。
極氪汽車為煥新極氪 007GT 推出「河谷綠」外飾色與「墨綠」內飾。2026 年 10 月 1 日至 10 月 31 日下定該車,可享更多限時權益;煥新極氪 007/007GT 均採用 900V 高壓架構,匹配麒麟電池,最高續航達 905 公里,百公里加速最快 2.73 秒。
Meta 公佈 Ray-Ban Display 眼鏡 2026 年下半年大型更新詳情,涵蓋導航、通知管理、Hologram 虛擬化身及 Explore 應用推薦。
OpenAI 推出面向開發者的新網誌,將刊載技術深入文章、版本更新説明及最佳實踐,並由工程師直接分享工具與功能資訊。首批兩篇文章包括 Realtime API 開發者備忘,聚焦整合 GA Realtime API 及新即時模型時涉及的重要技術變更。
Alpic 分享 ChatGPT Apps 開發的 15 項經驗,並將部分做法納入開源 Skybridge 框架及 chatgpt-apps-builder Codex 技能。
OpenAI 宣佈即日起,Codex 可透過 Figma MCP server 在 Figma 與程式碼間雙向協作,並將運行中的介面轉成可編輯的 Figma frames。
OpenAI 為 Codex Code Review 加入自訂倉庫規則支援,讓它可按 AGENTS.md 中的指引檢查改動,並在審查發現中引用相關規則。在包含已知違規和安全反例的主要評測套件中,規則引導版本識別出 98% 的必要自訂問題,基線對照組為 58.3%。
OpenAI 介紹 Rosalind Workbench,讓每位科學家都能成為自己的研究團隊。它透過引導式任務、科學檢視器及定序分析,協助研究人員循研究問題從數據追尋證據。
Justin 推出 Breadcrumb,一款為 Mac 設計的本機工具,可記錄螢幕、會議及 AI 對話與操作,並整理為 AI 可搜尋的記憶和上下文規則。作者舉例,Claude 讀取會議記錄、調取螢幕時間線並檢查程式碼後,建立 14 張 JIRA 工單、附上 12 張截圖,並草擬 Slack 訊息。
Anthropic 發佈開源 Bloom,這套 AI 智能體框架可按研究者指定的行為自動生成評測,並量化其在多種情境中的出現頻率與嚴重程度。Anthropic 同時公佈 16 個模型在妄想式迎合、受指示的長期破壞、自我保存和自我偏袒四類行為的基準;在 40 份轉錄中,Claude Opus 4.1 的評分與人工標註 Spearman 相關係數為 0.86。
Anthropic 發佈 Petri 2.0,為自動化行為審計工具新增 70 個 seed 指令、評測意識緩解改進和較新前沿模型的評測結果。真實感分類器與人工修訂 seed 指令合用時,Claude 模型的評測意識中位相對降幅為 47.3%,但部分模型的未提示主動性亦有下降。
Microsoft 推出 Copilot Health,作為 Copilot 內獨立且安全的健康空間,整合個人健康紀錄、穿戴式裝置數據及健康歷程,提供個人化健康洞察。
PyTorch Certified Associate(PTCA)認證新增學習路徑,透過 Linux Foundation Education 將四個自學模組與認證考試整合為一套學習體驗。
Cloudflare 發佈 Clef 和 Clef-flash 兩款面向 AI 智能體的決策模型,可對輸入同時回答多個預設問題並輸出各選項的概率,供下游程式路由、升級或轉交人工。
Apple 宣佈將為 macOS「Full Disk Access」加入額外控制,因 AI 智能體令這種高權限存取帶來更大風險。該設定可讓應用程式存取檔案、郵件、訊息及瀏覽記錄;Apple 稱日後用户須明確操作,才能授予這種權限。
Google 在 Gemini Enterprise Agent Platform 為 Agent Anomaly Detection 開放 Private Preview,提供自主智能體的推理式監督與審計層。
Google 將高級 Google Colab 權益納入 Google AI 訂閲,訂户可優先使用更快的加速器和效能更強的機器。Google AI Ultra 訂户另可使用不中斷的背景執行和 Premium GPU,讓長時間訓練無須保持瀏覽器分頁開啟。現有 Colab 訂閲不變,Google AI 訂閲權益可疊加;相關權益將於未來數週向 Colab 支援國家的 Google AI 訂户推出。
Google 宣佈 Antigravity SDK 支援多種本地模型與執行方式,初步支援透過 Google AI Edge 的 LiteRT 運行 Gemma 4 26B A4B,讓智能體協助可完全離線執行。
Google Cloud API Gateway 在 Public Preview 中可充當遠端 MCP server,將現有 REST 操作轉為智能體可調用的 MCP 工具。
Anthropic Economics 團隊的 Econ Scenario Explorer v1.0 讓使用者設定對 AI 能力、採用程度等因素的預期,推演 2030 年美國經濟情境。
OpenAI 推出 Rosalind Workbench,為生命科學研究者提供整合科學工具、資料分析工作流程與研究證據的虛擬工作台。產品以 research preview 形式透過 ChatGPT app 提供,包含 Explore 與 Research 兩種模式;已驗證的組織成員可代機構申請,個人使用權限即將推出。
MiniMax 將升級版 MiniMax Agent 更名為 Mavis,並推出 Agent Teams,讓桌面版可並行運行多個不同角色的 Agent,協作處理複雜任務。
Artificial Analysis 開源 AA-AgentPerf-Local,讓使用者在手提電腦及工作站上重播真實智能體軌跡,測試本地 AI 模型的推理效能。
Inception Labs 為每個新 Inception API key 提供 100M 免費 tokens,將免費層速率限制提高 10 倍,並持續改進 Mercury 2。
Grokipedia 在 v0.3 更新中調整設計,加入新標誌並改版首頁與即時編輯頁。新版首頁新增精選文章、最多人閲讀文章清單及「最新編輯」追蹤器;即時編輯頁則可同時查看更多近期更改。文章頁亦微調關鍵資料表格版式並縮小行距,整體外觀大致不變。
OpenAI 在 Dev Day 公佈 Decisions API,讓 Luna 模型從預設選項中作選擇,功能似乎接近 Jev。該 API 目前以有限預覽形式提供,與 Jev 的相似程度尚未明確;Sam Altman 表示,聚焦於選項可令模型極快運作,同時保留圖像理解、廣泛語言支援和安全防護。
Legato 宣佈 AI 助聽眼鏡 Legato Frames 現已開售,售價 $999 起,適用於有中度或以下聽力損失的成年人。產品把公司的專利助聽技術整合於眼鏡鏡臂,AI 系統會分辨人聲與背景噪音,放大人聲並降低不需要的聲音;公司稱所有處理均在眼鏡上完成,沒有攝影機或錄音。
Shopify 推出建站工具 Canvas,讓商家透過與 AI 智能體 Sidekick 對話建立 Shopify 網店,並即時查看頁面變化。Shopify 稱,Canvas 呈現的是店舖實際程式碼渲染的結果,而非靜態預覽,商家可測試頁面互動與動畫,並查看不同螢幕尺寸下的呈現。