跳到正文
原文
OpenAI News·· 2025-12-22AI 评分33

OpenAI 持续强化 ChatGPT Atlas 的提示词注入防御

Continuously hardening ChatGPT Atlas against prompt injection

AI 导读

OpenAI 正利用基于强化学习训练的自动化红队持续加固 ChatGPT Atlas,对抗提示词注入攻击。这种主动的"发现—修补"循环可提前识别新型攻击手法,随着 AI 越来越智能体化,不断强化该浏览器智能体的防御能力。

来源:OpenAI News · openai.com