跳到正文
原文
OpenAI News·· 2026-03-10AI 评分32

OpenAI 推出 IH-Challenge 改进前沿 LLM 的指令层级

Improving instruction hierarchy in frontier LLMs

AI 导读

OpenAI 的 IH-Challenge 训练模型优先遵循可信指令,以改进前沿 LLM 的指令层级。该方法同时提升了安全可操纵性,并增强了对提示词注入攻击的抵抗力。

来源:OpenAI News · openai.com