跳到正文
原文
Hugging Face Blog·· 2025-08-14精选AI 评分60

Hugging Face 开源 Kimina-Prover-RL 训练管线并发布 1.7B 与 0.6B 模型

Kimina-Prover-RL

AI 导读

Hugging Face 与 AI-MO 开源了 kimina-prover-rl 训练管线,用于 Lean 4 形式化定理证明,采用受 DeepSeek-R1 启发的先推理后生成范式,基于 GRPO 与 Verl 框架,训练配方以 recipe/kimina-prover-rl 形式随 Verl fork 发布。

推荐理由

原文给出了完整的训练配方与开源入口,读者可据此复现小参数模型上的强化学习定理证明流程。

来源:Hugging Face Blog · huggingface.co