OpenAI News·· 2026-03-05精选AI 评分
OpenAI 提出 CoT-Control:推理模型难以控制自身思维链
OpenAI 提出 CoT-Control,发现推理模型难以控制自己的思维链,这一结果支持将可监控性作为 AI 安全防护手段。材料仅提供摘要,未给出具体模型、评测指标或实验细节。
OpenAI 提出 CoT-Control 并给出推理模型难以控制思维链的观察,为可监控性作为安全手段提供了依据。
当前提供 AI 导读,完整正文请阅读原文。
来源:OpenAI News · openai.com