LlamaIndex 2026-03-10 電子報
LlamaIndex 本期電子報介紹其由 RAG 框架發展為智能體文件處理平台,並聚焦 LlamaParse、耐久工作流程及文件解析工具更新。平台服務 300k+ 用户、支援 50+ 格式;DBOS 整合提供自動步驟持久化與崩潰復原,另有簡報搜尋及 PDF 圖表解析工具。
LlamaIndex 本期電子報介紹其由 RAG 框架發展為智能體文件處理平台,並聚焦 LlamaParse、耐久工作流程及文件解析工具更新。平台服務 300k+ 用户、支援 50+ 格式;DBOS 整合提供自動步驟持久化與崩潰復原,另有簡報搜尋及 PDF 圖表解析工具。
LlamaIndex 開源 LiteParse,這款 CLI 和 TS 原生程式庫可在本機解析 PDF、Office 文件及圖片,為 AI 智能體抽取保留版面關係的文字,且不依賴 Python。
LlamaIndex 推出開源 LiteParse,這是一款基於多年 LlamaParse 開發經驗打造的輕量本機文件解析器。LiteParse 支援版面保留、本機 OCR 及多模態 LLM,並可透過 `npm i -g @llamaindex/liteparse` 安裝。
LlamaParse 更新了 Word(.docx)文件的表格解析方式,改為直接從 Word XML 擷取表格內容並保留原始結構。其專有技術會將 Word XML 表格元素對應至渲染結果中的正確頁面位置,並把 XML 表格內容轉換為 Markdown;這項更新目前適用於 .docx 表格。
LlamaIndex 本期電子報宣佈推出 LiteSearch 本地文件檢索系統,並聚焦文件解析能力更新。LiteSearch 以 LiteParse 建構檢索流程,涵蓋解析、分塊、嵌入向量與向量儲存,無需外部依賴;電子報亦介紹 .docx 表格頁面定位改進,以及整合 Gemini 3.1 Live API 的語音助理示範。
LlamaIndex 為智能體提供 LlamaParse 與 LiteParse 技能,讓支援可安裝技能的執行環境調用結構化文件解析。LlamaParse 連接 LlamaIndex 的雲端解析 API,適合複雜版面、表格和圖表;LiteParse 則透過 CLI 工具 `lit` 在本機處理文件,並可輸出保留空間關係的 JSON、使用 OCR。
LlamaIndex 重構 LlamaParse Platform MCP,將重心由儲存與檢索轉向由 Parse、Classify 和 Split 服務支援的文件處理。
LlamaIndex 推出 LiteParse Server,將 LiteParse 封裝為可自託管的 HTTP API,供不同語言或服務作為文件解析後端。它支援 PDF、Office 文件和圖片,提供帶有文字位置與邊界框的解析結果,並設有 /parse 和 /screenshots 兩個端點。
LlamaIndex 發佈 LiteParse v2.0,提供 Rust、Node、Python 和 WASM 套件,可在瀏覽器及 edge runtimes 執行。
LlamaIndex 宣佈 LlamaParse 推出精細邊界框功能,可按行、字詞及表格儲存格標示文件位置。只有頁面上明確存在的文字會獲分配座標,推斷值、AI 摘要及重建內容則不會有邊界框。功能現以 beta 形式向所有付費方案提供,建立解析任務時須以單一參數選擇啟用;Agentic Plus 會額外執行驗證輪次以提升精度。
LlamaIndex 推出 LiteParse v2.1,新增以啟發式規則實現的無模型 PDF 轉 Markdown 管線。文章稱它在 3 項基準中領先同類無模型開源工具;文首列出的分數為 opendataloader-bench 0.875、olmOCR-bench 0.391、ParseBench 0.3279,後文表格則分別列出 0.871、39.2% 和 0.328。
LlamaIndex 擴展 LlamaParse MCP,加入 Extract 服務整合、Index v2 的智能體知識存取,以及按產品劃分的專用 MCP 端點。
LlamaIndex 在 LlamaParse Index 中加入 Retrieval Harness,並將該功能及其他更新以 Beta 形式開放予所有付費方案。
LlamaIndex 在 7-15-26 電子報公佈多項產品更新,涵蓋抽取、Markdown 輸出、表格處理和方案席位。Conversational Extract 可透過對話建立抽取 schema,fast tier 預設輸出 Markdown,Agentic Plus 的表格處理有所改善,所有方案(包括免費方案)均支援 100 位使用者。
LlamaIndex 的 Parse Gateway 按頁面複雜度將文件分流至 LiteParse 或相應的 LlamaParse 層級,而非整份文件使用同一解析器。
Google 開源 Credentio C++ 庫,用於驗證 C2PA Content Credentials,起步支援規格版本 2.2 和 2.4。其 API 可在開發者應用程式本地執行驗證,媒體檔案毋須傳送至雲端或外部驗證端點;驗證大型檔案時,Credentio 使用的記憶體亦少於其他方案。
LlamaIndex 在 LlamaParse Platform 推出 Turbo Beta 文件抽取層,面向低延遲的即時工作流。在 ExtractBench 上,Turbo 比 Cost Effective 快約 4 倍,單頁中位處理時間為 3.7 秒,F1 為 0.84;它直接從文件頁面抽取內容並行處理,中、長文件約為每頁 0.5 秒。
Google 宣佈 ADK for Kotlin 1.0 正式推出,為 Kotlin、Android 及伺服器端開發提供 AI 智能體工具包。版本功能與 ADK 1.0 Core 完整對齊,涵蓋多智能體協調、上下文壓縮、多輪對話、人工確認和工作階段恢復。
LlamaIndex 更新 LiteParse,PDFium 優化令文字抽取耗時減少 20-25%,並改善 Markdown 解析表現,新增視覺定位及 is-complex API。
LlamaIndex 發佈文件抽取智能體 Extract v2.5,提升所有檔位的準確度,且每頁收費不變。ExtractBench 上,Cost Effective 的整體 value F1 由 87.1 升至 93.9,Agentic 由 89.8 升至 95.8,Agentic Plus 由 95.1 升至 96.4。
MemoMind One 將於明日進駐全國 56 家線下門店及 INNO100 全球創新旗艦店,並開放定金預訂。10 月 3 日至 10 月 14 日到店預付 100 元定金,可獲贈價值 199 元墨鏡夾片 1 副。官方稱眼鏡具備 AI 記憶、導航和提詞功能,結合極米顯示、蔡司光學與哈曼聲學,目前尚未公佈配置資訊。
大眾安徽與眾 09 夏測實車亮相,並已開啟預售,售價 19.99 萬元起。新車搭載端到端智能輔助駕駛模型,可實現高速/城區 NOA 和車位到車位 AI 代駕,並標配圖靈 AI 晶片,總算力 750TOPS。
鈦度推出輕鸞 2 頭戴式耳機,售價 159.9 元,主打輕量化機身。耳機重約 230g,搭載 50mm 發聲單元,支援 7.1 遊戲音效與音樂雙模式,並提供 2.4G、藍牙 6.0 及有線 USB 連接。產品內置 1000mAh 電池,配備可插拔全指向 AI 降噪麥克風。
NVIDIA 推出 DGX Spark 64GB 版本,起售價 4,999 美元,並將於 10 月 23 日發售。產品基於 GB10 Grace-Blackwell,約 56GB 記憶體可供模型權重與 KV cache 使用,並最多支援 4 台設備組成集羣。官方實測兩台設備組成集羣運行 Qwen3.8-27B,相比單台設備性能最高提升 1.7 倍。
Meta 宣佈,旗下 AI 智能體 Muse 將於近期登陸智能眼鏡,用户可透過語音指令讓它在後台代辦任務。Muse 基於 Muse Spark AI 模型運行,使用持續運作的雲端 Linux 虛擬機,並可自行編寫、執行程式碼或把工作分派給多個子智能體。
極氪汽車為煥新極氪 007GT 推出「河谷綠」外飾色與「墨綠」內飾。2026 年 10 月 1 日至 10 月 31 日下定該車,可享更多限時權益;煥新極氪 007/007GT 均採用 900V 高壓架構,匹配麒麟電池,最高續航達 905 公里,百公里加速最快 2.73 秒。
Meta 公佈 Ray-Ban Display 眼鏡 2026 年下半年大型更新詳情,涵蓋導航、通知管理、Hologram 虛擬化身及 Explore 應用推薦。
OpenAI 推出面向開發者的新網誌,將刊載技術深入文章、版本更新説明及最佳實踐,並由工程師直接分享工具與功能資訊。首批兩篇文章包括 Realtime API 開發者備忘,聚焦整合 GA Realtime API 及新即時模型時涉及的重要技術變更。
OpenAI 整理 Realtime API 與 gpt-realtime 語音對語音模型進入 GA 後的介面變更、新功能及整合注意事項。文章建議客户遷移至 GA 介面,並説明 beta 與 GA 在功能支援、temperature 和非同步函式呼叫上的差異。
推薦理由:文章對照 beta 與 GA 的功能支援差異,並説明介面遷移、temperature 設定及長對話截斷的處理方式,方便開發者按整合環節核對需要調整的設定。
OpenAI 宣佈即日起,Codex 可透過 Figma MCP server 在 Figma 與程式碼間雙向協作,並將運行中的介面轉成可編輯的 Figma frames。
OpenAI 為 Codex Code Review 加入自訂倉庫規則支援,讓它可按 AGENTS.md 中的指引檢查改動,並在審查發現中引用相關規則。在包含已知違規和安全反例的主要評測套件中,規則引導版本識別出 98% 的必要自訂問題,基線對照組為 58.3%。
OpenAI 介紹 Rosalind Workbench,讓每位科學家都能成為自己的研究團隊。它透過引導式任務、科學檢視器及定序分析,協助研究人員循研究問題從數據追尋證據。
Justin 推出 Breadcrumb,一款為 Mac 設計的本機工具,可記錄螢幕、會議及 AI 對話與操作,並整理為 AI 可搜尋的記憶和上下文規則。作者舉例,Claude 讀取會議記錄、調取螢幕時間線並檢查程式碼後,建立 14 張 JIRA 工單、附上 12 張截圖,並草擬 Slack 訊息。
Anthropic 發佈開源 Bloom,這套 AI 智能體框架可按研究者指定的行為自動生成評測,並量化其在多種情境中的出現頻率與嚴重程度。Anthropic 同時公佈 16 個模型在妄想式迎合、受指示的長期破壞、自我保存和自我偏袒四類行為的基準;在 40 份轉錄中,Claude Opus 4.1 的評分與人工標註 Spearman 相關係數為 0.86。
Anthropic 發佈 Petri 2.0,為自動化行為審計工具新增 70 個 seed 指令、評測意識緩解改進和較新前沿模型的評測結果。真實感分類器與人工修訂 seed 指令合用時,Claude 模型的評測意識中位相對降幅為 47.3%,但部分模型的未提示主動性亦有下降。
Microsoft 推出 Copilot Health,作為 Copilot 內獨立且安全的健康空間,整合個人健康紀錄、穿戴式裝置數據及健康歷程,提供個人化健康洞察。
PyTorch Certified Associate(PTCA)認證新增學習路徑,透過 Linux Foundation Education 將四個自學模組與認證考試整合為一套學習體驗。
作者實測 OpenAI 的 Dots 智能體,發現它更像可操作其他軟件的工作助理,處理個人購物時則屢受網站安全檢查阻礙。取得電腦存取權後,Dots 成功整理影片及更新個人網站;在協助登入 Uber Eats 後,也訂到了照燒餐。作者透過每月 $100 的 Pro 賬户測試,認為以自己的工作需求而言,Dots 尚不值這個月費。
Apple 宣佈將為 macOS「Full Disk Access」加入額外控制,因 AI 智能體令這種高權限存取帶來更大風險。該設定可讓應用程式存取檔案、郵件、訊息及瀏覽記錄;Apple 稱日後用户須明確操作,才能授予這種權限。
Google 在 Gemini Enterprise Agent Platform 為 Agent Anomaly Detection 開放 Private Preview,提供自主智能體的推理式監督與審計層。