OpenAI News·· 2025-08-07AI 评分53
OpenAI 详解 GPT-5 的 safe-completions 安全训练方法
From hard refusals to safe-completions: toward output-centric safety training
AI 导读
OpenAI 发布文章,介绍 GPT-5 采用的 safe-completions 安全训练方法,用更细致的输出安全策略替代硬拒绝,以处理双用途提示。该方法据称在提升安全性的同时也改善了回答的有用性。
来源:OpenAI News · openai.com