跳到正文
原文
OpenAI News·· 2024-12-20精选AI 评分60

OpenAI 发布 Deliberative alignment 研究,让 o1 模型通过推理执行安全规范

Deliberative alignment: reasoning enables safer language models

AI 导读

OpenAI 推出面向 o1 模型的新对齐策略 Deliberative alignment,直接教模型安全规范并让其对这些规范进行推理。该方法旨在通过推理能力提升语言模型的安全性。

推荐理由

OpenAI 官方介绍了 o1 系列采用的对齐策略思路,可作为理解推理能力如何用于安全规范的参考材料。

来源:OpenAI News · openai.com