OpenAI News·· 2022-01-27精選AI 評分78
OpenAI 透過對齊研究訓練 InstructGPT,使語言模型遵循指令
Aligning language models to follow instructions
AI 導讀
OpenAI 表示,透過對齊研究訓練的 InstructGPT 比 GPT-3 更能遵循用户意圖,同時回答更真實、毒性更低。這些由人類參與訓練的模型已部署為 OpenAI API 的預設語言模型。
推薦理由
材料交代了 InstructGPT 相較 GPT-3 的改進方向、人類參與訓練方式及 API 預設部署,呈現對齊研究如何落到實際服務。
來源:OpenAI News · openai.com