OpenAI News·2024-07-24 17:00· 2024-07-24AI 评分46OpenAI 用基于规则的奖励(RBRs)改进模型安全行为Improving Model Safety Behavior with Rule-Based RewardsAI 导读OpenAI 开发并应用了一种基于规则的奖励(Rule-Based Rewards,RBRs)新方法,用于对齐模型的安全行为,无需大量人工数据收集。该方法已在 OpenAI 的模型上落地应用。来源:OpenAI News · openai.com#论文/研究#安全/对齐#OpenAI