跳到正文
原文
OpenAI News·· 2024-12-20精选AI 评分61

OpenAI 为 o1 模型引入 deliberative alignment 对齐策略

Deliberative alignment: reasoning enables safer language models

AI 导读

OpenAI 发布新的对齐策略 deliberative alignment,用于 o1 模型,直接向模型教授安全规范并让模型围绕这些规范进行推理。

推荐理由

原文点明该策略直接教模型安全规范并对其推理,读者可据此理解对齐思路的变化。

来源:OpenAI News · openai.com