跳到正文
原文
OpenAI News·· 2024-12-20AI 評分46

OpenAI o1 模型的審議式對齊:推理讓語言模型更安全

Deliberative alignment: reasoning enables safer language models

AI 導讀

OpenAI 為 o1 模型引入新的審議式對齊策略,直接教授模型安全規範及如何據此推理。這項策略透過推理提升語言模型安全性。

來源:OpenAI News · openai.com