OpenAI News·· 2024-12-20精选AI 评分60
OpenAI 发布 Deliberative alignment 研究,让 o1 模型通过推理执行安全规范
Deliberative alignment: reasoning enables safer language models
AI 导读
OpenAI 推出面向 o1 模型的新对齐策略 Deliberative alignment,直接教模型安全规范并让其对这些规范进行推理。该方法旨在通过推理能力提升语言模型的安全性。
推荐理由
OpenAI 官方介绍了 o1 系列采用的对齐策略思路,可作为理解推理能力如何用于安全规范的参考材料。
来源:OpenAI News · openai.com