跳到正文
原文
OpenAI Developers·· 2025-07-21AI 評分66

如何提升 LLM 的正確性與一致性

LLM correctness and consistency

AI 導讀

OpenAI 提出提升 LLM 正確性與行為一致性的優化框架,建議先透過評估診斷失誤,再按問題選用提示詞、RAG 或微調。在冰島語校正測試中,GPT-4 零樣本的 BLEU 為 62,加入 3 個 few-shot examples 後為 70;以 1000 個例子微調 GPT-4 後為 87,再加入 RAG 則降至 83。

來源:OpenAI Developers · platform.openai.com