当前位置:首页 > Deepseek应用场景 > 正文内容

DeepSeek-Prover-V2:AI 数学推理新王者,88.9% 通过率设新标杆

2个月前 (05-01)Deepseek应用场景154

IT之家 5 月 1 日消息,深度求索(DeepSeek)昨日(4 月 30 日)在 AI 开源社区 Hugging Face 上,发布名为 DeepSeek-Prover-V2-671B 的新模型,随后在 GitHub 等平台上公布了论文信息。

IT之家援引论文介绍,DeepSeek-Prover-V2 是一款专注于形式化数学推理的开源大型语言模型,基于 DeepSeek-V3-0324,通过递归定理证明管道生成初始数据。

Deepseek 推出了 DeepSeek-Prover-V2-671B(结合 V3 基础大模型)、DeepSeek-Prover-V2-7B(增强模型)两个模型,以及 DeepSeek-ProverBench 数据集。

DeepSeek-Prover-V2-671B 采用和 DeepSeek V3-0324 相同的架构,并非用于常规对话或者推理,而是用于形式化定理证明、专门增强数学能力的模型。

DeepSeek 团队首先引导 DeepSeek-V3 模型将复杂定理分解为一系列子目标(subgoals),整合非形式与形式化数学推理,在 Lean 4 平台上形式化证明步骤。

接着,利用一个较小的 7B 参数模型处理子目标的证明搜索,减轻计算负担。最终,结合完整的逐步证明与 DeepSeek-V3 的思维链(chain-of-thought),形成强化学习的“冷启动”数据。

在训练中,团队筛选出一批 7B 模型无法直接解决但子目标已被证明的难题。通过整合子目标证明,形成完整的形式化证明,并与 DeepSeek-V3 的推理过程对接,生成合成数据。

随后,模型微调这些数据,并通过强化学习进一步提升能力,以二元反馈(正确或错误)作为奖励机制。最终,DeepSeek-Prover-V2-671B 在神经定理证明领域创下新高,在 MiniF2F-test 数据集上通过率达 88.9%,在 PutnamBench 数据集中解决 658 个问题中的 49 个。

团队还发布了 ProverBench 基准数据集,包含 325 个形式化数学问题。其中,15 个问题源自近期 AIME 竞赛(AIME 24 和 25),涉及数论与代数,代表高中竞赛难度。

其余 310 个问题则来自精选教材和教学内容,涵盖线性代数、微积分、概率等多个领域。这一数据集旨在为高中竞赛和本科数学提供全面评估标准,推动模型在多样化场景下的测试与应用。

相关阅读:

《DeepSeek-Prover-V2-671B 新模型开源发布》


“DeepSeek-Prover-V2:AI 数学推理新王者,88.9% 通过率设新标杆” 的相关文章

DeepSeek接入完毕,武汉硚口的这些业务可一键办理

DeepSeek接入完毕,武汉硚口的这些业务可一键办理

极目新闻通讯员 李刚近日,武汉市硚口区行政审批局“公司宝典”微信公众号接入深度求索(DeepSeek)人工智能模型,开创了湖北省省市场主体登记领域使用生成式AI服务群众的先河。公司宝典微信公众号据悉,...

DeepSeek说:如果你是人类,你最期待什么样的另一半?

DeepSeek说:如果你是人类,你最期待什么样的另一半?

如果我是人类,寻找另一半时,我可能会更注重以下几个方面的契合:1. 心智的共鸣比起外在条件,我更希望彼此能在思维深度和价值观上产生化学反应。比如对世界的好奇心、对成长的追求、对善良与真诚的坚持,甚至对...

华自科技:公司水利水电智能运维大模型已完成DeepSeek全面接入

华自科技:公司水利水电智能运维大模型已完成DeepSeek全面接入

每经AI快讯,华自科技3月7日在互动平台表示,公司“共工”水利水电智能运维大模型已完成DeepSeek全面接入,将焕新升级“智能交互、数据驱动、深度思考、主动服务”四大核心能力,以AI深度协同赋能水利...

人均DeepSeek!当教育硬件遇上深度推理,AI教育爆发了

人均DeepSeek!当教育硬件遇上深度推理,AI教育爆发了

最近这互联网,确实有点意思。前天上午,我打开微博,映入眼帘的第一条消息就是“微信DeepSeek王炸组合”;昨天中午,趁着上班中途准备打开贴吧摸鱼,结果却看到破防的MYGO粉丝在讨论“用DeepSee...

甘肃简牍博物馆导览AI机器人接入DeepSeek大模型

甘肃简牍博物馆导览AI机器人接入DeepSeek大模型

甘肃简牍博物馆导览AI机器人接入DeepSeek大模型每日甘肃网兰州讯(新甘肃·甘肃日报记者 白永萍)近日,甘肃简牍博物馆导览AI机器人“小简”“小牍”正式接入DeepSeek大模型,将以更加智能高效...

阿里云王坚谈DeepSeek、宇树启示:小公司也能颠覆

阿里云王坚谈DeepSeek、宇树启示:小公司也能颠覆

凤凰网科技讯(作者/刘毓坤、董雨晴)5月22日,BEYOND Expo 2025大会在中国澳门开幕,中国工程院院士、之江实验室主任、阿里云创始人王坚出席开幕式。王坚与凤凰网科技有一场面对面的谈话。在谈...