跳到正文
原文
OpenAI News·· 2024-12-20AI 评分56

OpenAI 提出审议式对齐:用推理提升语言模型安全性

AI 导读

OpenAI 为 o1 模型提出新的对齐策略“审议式对齐(deliberative alignment)”,直接教模型安全规范以及如何对这些规范进行推理。该策略面向 o1 系列模型,目标是让推理能力服务于更安全的语言模型。

当前提供 AI 导读,完整正文请阅读原文。

来源:OpenAI News · openai.com