跳到正文
原文
OpenAI News·· 2022-01-27精選AI 評分78

OpenAI 透過對齊研究訓練 InstructGPT,使語言模型遵循指令

Aligning language models to follow instructions

AI 導讀

OpenAI 表示,透過對齊研究訓練的 InstructGPT 比 GPT-3 更能遵循用户意圖,同時回答更真實、毒性更低。這些由人類參與訓練的模型已部署為 OpenAI API 的預設語言模型。

推薦理由

材料交代了 InstructGPT 相較 GPT-3 的改進方向、人類參與訓練方式及 API 預設部署,呈現對齊研究如何落到實際服務。

來源:OpenAI News · openai.com