OpenAI News·2024-04-20 03:00· 2024-04-20AI 评分40OpenAI 提出指令层级:训练 LLM 优先执行特权指令AI 导读OpenAI 提出"指令层级"方法,训练 LLM 优先执行特权指令,以抵御提示词注入、越狱等攻击。当前 LLM 易被对抗者用恶意提示词覆盖原始指令,该方法旨在让模型区分指令优先级。正文阅读原文 当前提供 AI 导读,完整正文请阅读原文。来源:OpenAI News · openai.com#论文/研究#安全/对齐#OpenAI