首页 > AI前沿 > Deliberative alignment: reasoning enables safer language models

Deliberative alignment: reasoning enables safer language models

OpenAI 2024-12-20 18:00 1 阅读 查看原文

Deliberative alignment: reasoning enables safer language models

Introducing our new alignment strategy for o1 models, which are directly taught safety specifications and how to reason over them.