跳到正文
原文
OpenAI News·· 2025-08-07AI 评分53

OpenAI 详解 GPT-5 的 safe-completions 安全训练方法

From hard refusals to safe-completions: toward output-centric safety training

AI 导读

OpenAI 发布文章,介绍 GPT-5 采用的 safe-completions 安全训练方法,用更细致的输出安全策略替代硬拒绝,以处理双用途提示。该方法据称在提升安全性的同时也改善了回答的有用性。

来源:OpenAI News · openai.com