您的当前位置:首页 > 标签 > DeepSeek-R1推理能力对标
【华龙证券】AI产业系列跟踪专题研究报告:DeepSeek重塑AI产业格局,助力AI端侧落地-250210(12页).pdf
DeepSeek-R1推理能力对标:比肩OpenAI o1,蒸馏小模型超越o1-mini|华龙证券
华龙证券分析DeepSeek-R1推理能力:性能比肩OpenAI o1正式版,蒸馏Qwen-32B模型AIME达72.6%;强化学习后训练仅用极少标注数据,API定价每百万输出16元。长尾关键词:DeepSeek-R1推理模型,强化学习大模型。
 2026-07-30
 互联网产业
 12页
1张图表
数据来源:
【华龙证券】AI产业系列跟踪专题研究报告:DeepSeek重塑AI产业格局,助力AI端侧落地-250210(12页) 查看报告
华龙证券发布的《DeepSeek重塑AI产业格局,助力AI端侧落地》报告指出,DeepSeek-R1推理模型在后训练阶段大规模使用强化学习技术,仅用极少标注数据即极大提升推理能力,在数据、代码、自然语言推理等任务上性能比肩OpenAI o1正式版。公司同时开源DeepSeek-R1-Zero和DeepSeek-R1两个660B模型,并通过R1输出蒸馏6个小模型,其中32B和70B模型在多项能力上实现对OpenAI o1-mini的对标与超越。

DeepSeek-R1性能比肩OpenAI o1正式版

2025年1月20日,DeepSeek发布了推理模型DeepSeek-R1,该模型在后训练阶段大规模使用了强化学习技术【1†L4-L5】。在仅仅使用极少标注数据的情况下,极大提升了模型推理能力【1†L4-L5】。在数据、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版【1†L4-L5】。DeepSeek-R1 API服务定价为每百万输入tokens 1元(缓存命中)/4元(缓存未命中),每百万输出tokens 16元,性价比优势显著【1†L4-L5】。

强化学习驱动推理能力跃升

DeepSeek-R1在后训练阶段大规模使用强化学习技术,这是其推理能力实现跃升的核心驱动力【1†L4-L5】。传统大模型依赖大量标注数据进行监督微调,而DeepSeek-R1通过强化学习,在仅使用极少标注数据的情况下,即可极大提升模型推理能力【1†L4-L5】。这一技术路线大幅降低了对标注数据的依赖,为推理模型的训练提供了更加高效和经济的路径。DeepSeek-R1在数学、代码、自然语言推理等复杂推理任务上展现出与OpenAI o1正式版相当的性能水平【1†L4-L5】。

蒸馏小模型超越OpenAI o1-mini

公司在开源DeepSeek-R1-Zero和DeepSeek-R1两个660B模型的同时,通过DeepSeek-R1的输出,蒸馏了6个小模型开源给社区【1†L4-L5】。其中32B和70B模型在多项能力上实现了对标OpenAI o1-mini的效果【1†L4-L5】。DeepSeek-R1-Distill-Qwen-32B在AIME 2024达72.6%、MATH-500达93.9%、GPQA Diamond达62.1%、LiveCodeBench达57.2%,全面超越o1-mini【1†L4-L5】。蒸馏小模型的成功证明了大模型的推理能力可以有效迁移到更小、更高效的模型中,为端侧部署提供了可能。
表3:DeepSeek-R1蒸馏小模型与o1-mini性能对比
模型AIME 2024MATH-500GPQA DiamondLiveCodeBench
o1-mini63.690.060.053.8
DeepSeek-R1-Distill-Qwen-32B72.693.962.157.2
DeepSeek-R1-Distill-Llama-70B70.086.765.257.5
DeepSeek-R1-Distill-Qwen-14B69.793.959.153.1

长链推理蒸馏技术提升V3模型性能

在后训练阶段,DeepSeek引入了一种创新方法,将长链推理(Chain-of-Thought, CoT)模型中的推理能力蒸馏到标准大语言模型中【2†L5-L6】。该模型将R1的验证和反思模式融入DeepSeek-V3,并显著提升了其推理性能【2†L5-L6】。同时控制了DeepSeek-V3的输出风格和长度【2†L5-L6】。这一技术路径使得DeepSeek-V3在保持基础能力的同时,获得了更强的推理能力,进一步缩小了与顶尖推理模型的差距。

推理模型低成本API推动AI应用落地

DeepSeek-R1 API服务定价为每百万输入tokens 1元(缓存命中)/4元(缓存未命中),每百万输出tokens 16元【1†L4-L5】。极低的推理成本使得开发者可以更低门槛地调用顶尖推理模型的能力,推动AI在更多场景中的落地应用。DeepSeek-R1已作为NVIDIA NIM微服务预览版上线,并被微软纳入Azure AI Foundry平台,企业可以通过无服务器端点访问该模型【1†L4-L5】。推理模型的低成本化将加速AI在代码生成、数据分析、复杂决策等高价值场景中的商业化应用。

Meta Description见标题下方。

导语见正文起始。
客服
商务合作
小程序
服务号
折叠