跳到正文
原文
OpenAI News·· 2025-08-27精选AI 评分61

OpenAI 与 Anthropic 公布首次联合安全评估结果

OpenAI and Anthropic share findings from a joint safety evaluation

AI 导读

OpenAI 与 Anthropic 公布首次联合安全评估结果,双方互相测试对方模型在错位对齐、指令遵循、模型幻觉和越狱等方面的表现,展示了进展、挑战以及跨实验室协作的价值。

推荐理由

两家头部实验室互测对方模型并公开结果,可了解跨机构协作评估的做法与发现的问题。

来源:OpenAI News · openai.com