跳到正文
原文
Hugging Face Blog·· 2025-02-02精选AI 评分65

Hugging Face 发布 Open-R1 项目进展:复现 DeepSeek-R1 训练管线与数据

Open-R1: Update #1

AI 导读

Hugging Face 更新 Open-R1 项目进展,旨在复现 DeepSeek-R1 缺失的训练管线和合成数据。团队已在 MATH-500 基准上验证评估结果,并将 GRPO 集成至 TRL v0.14 以支持并行训练。

推荐理由

原文公开了复现 DeepSeek-R1 的训练管线与合成数据生成细节,提供了可参考的工程实现方案。

来源:Hugging Face Blog · huggingface.co