跳到正文
原文
LlamaIndex:產品、工程與評測·· 4 天前AI 評分49

使用 DeepEval 和 LlamaIndex 評估 RAG

Evaluating RAG with DeepEval and LlamaIndex

AI 導讀

DeepEval 與 LlamaIndex 的示例展示如何評估 RAG 流程,檢視生成答案及檢索內容的品質。示例採用 Answer Relevancy、Faithfulness 和 Contextual Precision,分別評估答案相關性、事實忠實度與檢索排序。DeepEval 提供 50+ 預置指標及自訂指標建構器,可依評測分數調整模型、提示詞模板、top-K 設定和嵌入模型。

來源:LlamaIndex:產品、工程與評測 · llamaindex.ai