OpenAI Developers·· 2024-05-29AI 評分59
OpenAI Developers 示範以 GPT-4o 開發模型幻覺防護欄
Developing Hallucination Guardrails
AI 導讀
OpenAI Developers 的 Notebook 示範以 GPT-4o 建立檢查客服智能體回覆是否出現幻覺的輸出防護欄。流程先生成客服政策與對話作為評測集,再按句檢查事實準確性、相關性、政策遵循及上下文連貫性。文中報告 precision 為 0.97、recall 為 1.00。
來源:OpenAI Developers · developers.openai.com