OpenAI News·2017-08-03 15:00· 2017-08-03AI 评分40OpenAI 开源 RL-Teacher:通过人类反馈训练 AIAI 导读OpenAI 开源了 RL-Teacher,一个通过偶尔的人类反馈而非手工设计奖励函数来训练 AI 的接口实现。该技术旨在推进安全 AI 系统,也适用于奖励难以明确指定的强化学习问题。正文阅读原文 当前提供 AI 导读,完整正文请阅读原文。来源:OpenAI News · openai.com#开源/仓库#安全/对齐#数据/训练#OpenAI