Hugging Face Blog·· 2025-02-02精选AI 评分61
Hugging Face Open-R1 项目一周进展:复现评测、GRPO 训练与合成数据生成
Open-R1: Update #1
AI 导读
Hugging Face 发布 Open-R1 项目首周更新,称已在 MATH-500 Benchmark 上基本复现 DeepSeek-R1 蒸馏模型的报告分数,并上线了公开评测 leaderboard。
推荐理由
汇总了复现进度、训练管线细节和社区数据集,读者可据此评估开源复现 DeepSeek-R1 的可行性与路径。
来源:Hugging Face Blog · huggingface.co