OpenAI News·· 2024-12-20精选AI 评分61
OpenAI 为 o1 模型引入 deliberative alignment 对齐策略
Deliberative alignment: reasoning enables safer language models
AI 导读
OpenAI 发布新的对齐策略 deliberative alignment,用于 o1 模型,直接向模型教授安全规范并让模型围绕这些规范进行推理。
推荐理由
原文点明该策略直接教模型安全规范并对其推理,读者可据此理解对齐思路的变化。
来源:OpenAI News · openai.com