跳到正文
原文
Hugging Face Blog·· 2025-02-02精选AI 评分61

Hugging Face Open-R1 项目一周进展:复现评测、GRPO 训练与合成数据生成

Open-R1: Update #1

AI 导读

Hugging Face 发布 Open-R1 项目首周更新,称已在 MATH-500 Benchmark 上基本复现 DeepSeek-R1 蒸馏模型的报告分数,并上线了公开评测 leaderboard。

推荐理由

汇总了复现进度、训练管线细节和社区数据集,读者可据此评估开源复现 DeepSeek-R1 的可行性与路径。

来源:Hugging Face Blog · huggingface.co