跳到正文
原文
OpenAI News·· 2026-03-10AI 評分27

IH-Challenge 改善前沿大語言模型的指令層級

Improving instruction hierarchy in frontier LLMs

AI 導讀

IH-Challenge 訓練模型優先遵循可信指令,改善前沿大語言模型的指令層級。此訓練亦提升模型的安全可引導性,以及抵禦提示詞注入攻擊的能力。

來源:OpenAI News · openai.com