跳到正文

#教學/實踐

今日 8 條
10月3日週六
  1. LlamaIndex:產品、工程與評測52

    LlamaParse 如何結合 SharePoint 權限實現 RAG 內容檢索

    LlamaParse 的 SharePoint 整合支援權限感知檢索,可將 SharePoint 的細粒度存取控制用於 RAG 應用中的文件存取。建立索引並同步文件後,可在 chunks 預覽查看 allowed_siteUser_ids 等權限欄位。更新 SharePoint 檔案的共享對象並再次同步,chunks 預覽中的允許使用者清單會隨之變更。

  2. LlamaIndex:產品、工程與評測56

    LlamaParse 解析 PDF 實作指南

    LlamaIndex 示範如何用 LlamaParse 解析 PDF,並將文件內容轉成供 LLM 應用使用的結構化資料。Python 範例展示如何輸出 Markdown、解析表格,並啟用 auto mode 擷取圖表;解析設定亦可指定頁碼、排除頁面區域或加入提示詞。提取結果可進一步存入向量資料庫。

  3. LlamaIndex:產品、工程與評測47

    LlamaIndex:靈活而不失穩的有效 AI 智能體設計模式

    LlamaIndex 主張以 Workflows 設計 AI 智能體,在結構化執行與 LLM 自主決策之間取得平衡。Workflows 是支援 Python 和 TypeScript 的事件式系統,可編排智能體執行,並構建鏈式、分支、循環及扇出流程。文章建議將結構用於關鍵業務邏輯、易出錯操作和結構化輸出,將自主性用於非結構化輸入及新情況。

  4. LlamaIndex:產品、工程與評測39

    LlamaParse 擴展企業級 RAG 的 4 個方法

    LlamaIndex 分享 LlamaParse 擴展企業級 RAG 的四項實務要點:多租户負載調度、存取控制、文件解析與故障處理。平台託管調度控制可處理不同用户的負載差異;資料來源連接器會把檔案權限作為 metadata 寫入向量資料庫,供檢索按權限篩選。LlamaParse 保留文件結構、將表格轉為 Markdown 並提取圖片;資料匯入亦須應對第三方 AI 服務的限流、延遲和停機。

  5. LlamaIndex:產品、工程與評測47

    LlamaIndex:甚麼是上下文工程,以及可考慮的技巧

    LlamaIndex 闡釋上下文工程:為 AI 智能體挑選並整理相關資訊,以填充 LLM 的上下文窗口,而非只設計提示詞或處理 RAG 檢索。上下文可包括系統提示詞、用户輸入、短期及長期記憶、知識庫資料、工具定義與回應、結構化輸出及全局狀態。文章亦討論知識庫或工具的選擇,以及以摘要壓縮和排序,在有限的上下文窗口內保留相關資訊。

  6. LlamaIndex:產品、工程與評測49

    使用 DeepEval 和 LlamaIndex 評估 RAG

    DeepEval 與 LlamaIndex 的示例展示如何評估 RAG 流程,檢視生成答案及檢索內容的品質。示例採用 Answer Relevancy、Faithfulness 和 Contextual Precision,分別評估答案相關性、事實忠實度與檢索排序。DeepEval 提供 50+ 預置指標及自訂指標建構器,可依評測分數調整模型、提示詞模板、top-K 設定和嵌入模型。

  7. LlamaIndex:產品、工程與評測34

    超越 OCR:LLM 如何革新企業文件處理中的 PDF 解析

    LLM 正革新企業 PDF 解析,從單純讀取文字轉向理解文件版面與內容;LlamaParse 利用視覺語言模型處理文字和視覺元素,並保留文件結構。平台可處理表格、掃描文件、表單及技術圖紙,並透過 LlamaExtract 輸出 Markdown、JSON、XML 或自訂格式。服務提供免費及付費方案,實施指南涵蓋文件盤點、試點、擴展及正式部署。

  8. LlamaIndex:產品、工程與評測47

    使用 Oxylabs 與 LlamaIndex 構建更智能的 AI 智能體指南

    Oxylabs 與 LlamaIndex 的整合指南示範如何設定專用讀取器,並構建可透過 Google 搜尋取得即時網頁資料的 AI 智能體。整合提供 Google、Amazon、YouTube 的資料讀取器,也支援一般網站抓取,並可解析 HTML、應對反抓取措施。範例使用 OpenAI 的 gpt-4o-mini,文章指出此方案可降低頻繁網頁搜尋的成本。

  9. LlamaIndex:產品、工程與評測45

    用文件智能體自動化工作流程:使用 LlamaParse 建構具上下文感知能力 AI 的完整教學

    LlamaIndex 教學示範如何以 LlamaParse Index 配合開源智能體框架,建立可檢索企業文件並回答複雜問題的文件智能體。示例使用 JPMorgan Chase 存款帳户披露文件及利率協議,結合 Claude Sonnet 4、文件查詢工具和計算器,處理透支費用等多步推理任務。

  10. LlamaIndex:產品、工程與評測50

    LlamaIndex:解析與擷取——理解文件處理的兩種基本方法

    文件處理中,解析會把文件轉成供 AI 使用、並保留內容、結構與脈絡的格式;擷取則依預設 schema 抽出指定欄位,輸出結構化資料。解析適用於搜尋問答、RAG,以及需要保留文件脈絡的場景;擷取則適用於填入資料庫、處理表單和自動化業務流程。擷取並非取代解析,而是建立在解析之上,須先將文件轉成機器可讀內容,再識別、驗證並整理目標欄位。

  11. LlamaIndex:產品、工程與評測65

    超越 OCR:DeepSeek-OCR 的視覺壓縮如何服務文件 AI

    LlamaIndex 解讀 DeepSeek-OCR 將文件圖像作為文字資訊的壓縮表示,並分析其與文件解析、LlamaParse 的關係。文中稱,論文示例把 1,000 個文字 tokens 壓至 100 個視覺 tokens,解碼準確率為 97%;20× 壓縮時準確率約為 60%。文章指出,RAG、文件問答和摘要等理解型用途可考慮視覺壓縮;若需要結構化資料、語義層級或精確文字操作,仍需文件解析。

  12. LlamaIndex:產品、工程與評測56

    LlamaIndex 示範如何為智能體文件工作流程建立可觀測性

    LlamaIndex 示範以 Agent Workflows、OpenTelemetry 和 Jaeger,為財務文件分類及資料抽取流程建立可觀測性。範例用 LlamaClassify 將文件分類為損益表、現金流量表或資產負債表,再按類型以 LlamaExtract 擷取結構化資料;Jaeger 可查看一條 trace 中收集的五個 spans 和各步耗時。

  13. LlamaIndex:產品、工程與評測53

    智能體何時該用技能、何時該用 MCP 工具?LlamaIndex 比較兩者適用情境

    LlamaIndex 比較了智能體使用技能與 MCP 工具的取捨,指出 MCP 適合輸入輸出明確、要求可預測執行的操作,技能則適合以自然語言提供行為指引。MCP 以固定 schema 的 API 呼叫執行,但通常需要一定開發知識並帶來網絡延遲;技能以本地檔案提供指示,設定較輕,卻可能因 LLM 解讀而產生誤判或幻覺。

  14. LlamaIndex:產品、工程與評測47

    解析難以辨讀的文件:LlamaParse 如何處理訴訟證據開示文件

    LlamaParse 以多模態模型解析法律證據開示文件,可處理低畫質掃描件,並理解頁面版面、圖片、圖表及表格。它支援自訂解析指示,API 可回傳「markdown」、「text」及「items」等輸出。文章建議這類文件使用 `tier="agentic_plus"`,該層級針對複雜版面與視覺內容優化;所有 tier 均採用高解析度 OCR。

  15. LlamaIndex:產品、工程與評測45

    LlamaIndex:圖表數據提取逐步指南

    圖表數據提取須將圖中的視覺標記映射為座標數值,再整理成結構化資料;流程包括識別圖表類型、解析座標軸與圖例、定位數據點及匯出。人工數位化通常每張圖需 15 至 30 分鐘,傳統 OCR 只能辨識文字;AI/VLM(如 LlamaParse)可處理多種圖表,並輸出 CSV、JSON 或 Markdown,附信心分數與引用。

  16. LlamaIndex:產品、工程與評測29

    法律文件 OCR:準確度與合規要求

    法律文件 OCR 的結構錯誤與字符誤讀會妨礙 eDiscovery 搜尋、合約審查及合規記錄,並帶來法律風險。複雜版面下,傳統 OCR 的字符錯誤率為 3–8%;準確率達 98% 時,處理 50,000 頁仍有 1,000 頁出錯。文章探討智能體方法如何縮小差距,以及評估法律工作流程 OCR 軟件時應關注的因素。

  17. LlamaIndex:產品、工程與評測30

    建構 OCR 流程:提升效率的步驟

    要構建可靠的 OCR 流程,須整合文件輸入、影像預處理、文字檢測與識別、版面解析及驗證,將掃描件、PDF 和圖片轉為可供後續系統使用的結構化資料。文件格式、影像品質及表格與多欄版面各異,單靠字元識別容易遺失欄位、表格與文件區段之間的關係,各處理階段須協同運作以確保輸出可靠。

  18. LlamaIndex:產品、工程與評測34

    PDF 字元辨識:OCR 如何運作及在哪些情況下失效

    OCR 透過辨識掃描 PDF 中的像素字形,將影像文字轉成可搜尋、可選取的機器可讀文字。輸出可保留掃描影像並加入隱藏文字層,亦可用可編輯文字取代掃描影像。遇上多欄排版,閲讀次序可能被打亂;表格亦可能攤平成無結構文字,令辨識結果難以供機器使用。

  19. LlamaIndex:產品、工程與評測38

    金融文件欄位擷取範本:多數流程常犯的錯誤

    可靠的金融文件欄位擷取範本不能只列欄位,還須定義資料型別、結構、預期位置及驗證規則,以免系統因版面差異而靜默輸出錯誤數值。發票與銀行結單應採用分開的模組化結構並共用驗證層;OCR 之外,處理層亦須理解文件版面,否則規則式定位及逐頁擷取可能造成錯值、交易列遺漏或重複。

  20. LlamaIndex:產品、工程與評測48

    LiteParse 如何將 PDF 轉為文字:深入剖析網格投影演算法

    LiteParse 以網格投影演算法將 PDF 文字座標重建為純文字,利用等寬字元網格保留空間排列與對齊結構。演算法按 Y 座標容差將文字片段分行,並抽取左、右及置中錨點,將內容吸附至相應位置。空白壓縮可把 4 個空格的欄距縮為 2 個,以保留 LLM tokens 並維持版面資訊;GridDebugLogger 則可追蹤處理流程中的判斷。

  21. LlamaIndex:產品、工程與評測37

    護照 OCR:為何 MRZ 不只是兩行文字

    護照的 MRZ 不只是兩行待辨識文字,而是依 ICAO Document 9303 編碼、附有校驗碼的身份紀錄;TD3 格式每行 44 個字符,欄位校驗碼按 7-3-1 權重計算並取 modulo 10。只抽取字符而不驗證校驗碼,或不比對 VIZ 與 MRZ,便可能漏掉辨識錯誤及篡改差異。交叉驗證亦可在 VIZ 遭全息圖眩光遮擋時參照 MRZ 資料,並標記差異供審核。

  22. LlamaIndex:產品、工程與評測29

    貸款文件自動化:為何擷取層決定流程成敗

    貸款文件自動化的成敗取決於擷取與文件分類的準確度;只自動化流程轉送、沿用傳統 OCR,仍無法消除人工核對。採用 AI 決策但仍以舊式 OCR 擷取的貸款機構,仍須人工審查 40-60% 的檔案。Agentic OCR 會按頁面與元素類型識別文件、選擇模型並驗證擷取值,簡化後續收入計算、條件追蹤及承保審查。

  23. LlamaIndex:產品、工程與評測27

    保險文件 OCR:改造理賠流程

    保險理賠文件的 OCR 處理須超越文字辨識,重建結構化資料並保存欄位關聯,以支援理賠處理。系統結合機器學習、電腦視覺與版面感知解析,再按業務規則、保單保障及佐證文件驗證擷取值。信心評分用於判斷資料可否自動處理或須人工覆核;驗證後的資料可整合至理賠系統,支援自動決策、合規報告與分析工作流程。