OpenAI News·2024-12-20 18:00· 2024-12-20AI 評分46OpenAI o1 模型的審議式對齊:推理讓語言模型更安全Deliberative alignment: reasoning enables safer language modelsAI 導讀OpenAI 為 o1 模型引入新的審議式對齊策略,直接教授模型安全規範及如何據此推理。這項策略透過推理提升語言模型安全性。來源:OpenAI News · openai.com#安全/對齊#推理#OpenAI