OpenAI News·· 2022-01-27精选AI 评分
OpenAI 用对齐研究让语言模型更好遵循指令
Aligning language models to follow instructions
OpenAI 训练出比 GPT-3 更能遵循用户意图的语言模型,同时更真实、毒性更低,所用技术来自其对齐研究。这些名为 InstructGPT 的模型采用人类参与训练的方式,现已作为 OpenAI API 的默认语言模型部署。
OpenAI 说明 InstructGPT 如何通过人类反馈训练,让模型更贴合用户意图并成为 API 默认模型。
来源:OpenAI News · openai.com