OpenAI News·· 2026-03-10AI 評分27
IH-Challenge 改善前沿大語言模型的指令層級
Improving instruction hierarchy in frontier LLMs
AI 導讀
IH-Challenge 訓練模型優先遵循可信指令,改善前沿大語言模型的指令層級。此訓練亦提升模型的安全可引導性,以及抵禦提示詞注入攻擊的能力。
來源:OpenAI News · openai.com
Improving instruction hierarchy in frontier LLMs
IH-Challenge 訓練模型優先遵循可信指令,改善前沿大語言模型的指令層級。此訓練亦提升模型的安全可引導性,以及抵禦提示詞注入攻擊的能力。
來源:OpenAI News · openai.com