您的当前位置:首页 > 标签 > DeepSeek技术开源影响
资讯科技行业大模型深度:DeepSeek带来互联网新格局-250215(23页).pdf
2026 DeepSeek技术开源影响:R1登顶全球前三,API价格仅为o1的3.3%,技术平权重塑AI竞争格局|兴证国际
兴证国际研报显示DeepSeek-R1在Chatbot Arena排名全球第三,API输出价格仅2.19美元/百万tokens(o1的3.3%)。开源强化学习技术实现“技术平权”,互联网AI竞争从技术转向应用与生态,格局如何演变?
 2026-07-30
 AI产业
 23页
8张图表
数据来源:
资讯科技行业大模型深度:DeepSeek带来互联网新格局-250215(23页) 查看报告
DeepSeek的开源策略正在从根本上改变AI产业的竞争规则。兴证国际《大模型深度:DeepSeek带来互联网新格局》报告显示,DeepSeek-R1在Chatbot Arena排行榜上排名第三,成为首个登顶全球前三的国产大模型,API输出价格仅为每百万tokens2.19美元(OpenAI o1的3.3%)。更为重要的是,DeepSeek将“强化学习”方式与推理模型R1进行了完整开源,真正实现了“技术平权”。本文从开源生态、技术细节、产业影响三个维度,解析DeepSeek开源带来的行业变革。

DeepSeek开源“强化学习”技术细节,填补o1闭源留下的空白

OpenAI在2024年9月推出o1模型时选择了闭源策略,隐藏了思维链,使行业难以复制其强化学习训练方法。Sam Altman近期也表示:“我认为我们在这件事情上站在了历史的错误一边,OpenAI需要想出一种不同的开源策略。”这一空白由DeepSeek填补。2025年1月,DeepSeek不仅发布了R1推理模型,更开源了完整的技术细节——包括R1-Zero(完全不依赖监督微调的纯强化学习训练)、R1(结合多阶段训练和冷启动数据的推理模型)、以及基于Qwen和Llama从R1中提炼出的6个密集小模型(1.5B至70B)。DeepSeek开源的核心技术亮点包括:GRPO方法(Group Relative Policy Optimization)省去了传统PPO方法中需要额外训练价值网络的步骤,通过组内比较评估动作优劣,节省计算资源;R1-Zero证明了完全抛弃监督微调、仅靠强化学习也能让模型学会推理,模型在训练过程中自行出现了“顿悟时刻”,学会了用更长的思维链进行深度思考。

性能登顶全球前三,价格仅为o1的3.3%

DeepSeek-R1在Chatbot Arena排行榜以1,358分位列全球第三,与Gemini-2.0-Flash-Thinking-Exp-01-21(1,382分)、Gemini-Exp-1206(1,373分)同属第一梯队,超越了OpenAI o1-preview(1,335分)、o1-mini(1,305分)和DeepSeek-V3(1,317分)。在具体基准测试中,DeepSeek-R1在AIME 2024 pass@1达79.2%,超越o1-mini(63.6%);在MATH-500达96.4%;在Codeforces rating达2,061(超过93.4%人类程序员),在LiveCodeBench达63.4%。性能对标o1的同时,DeepSeek-R1的API定价却极具冲击力——每百万输入tokens 1元(缓存命中)/4元(缓存未命中),每百万输出tokens 16元(约2.19美元),而OpenAI o1输出价为60美元/百万tokens。DeepSeek-R1的输出价格仅为o1的3.3%。受此鲶鱼效应影响,OpenAI在2月1日推出o3-mini,输出价格降至4.4美元/百万tokens(较o1下降93%);谷歌于2月3日推出Gemini2.0 Flash系列,输入价格仅0.1美元/百万tokens。
DeepSeek-R1与OpenAI o1性能与价格对比
指标DeepSeek-R1OpenAI o1DeepSeek优势
Chatbot Arena排名全球第3(1,358分)第6(1,351分)排名领先
AIME 2024 pass@179.2%超越o1-mini
MATH-50096.4%高分
输出API价格2.19美元/百万tokens60美元/百万tokens仅为o1的3.3%
开源策略全开源(含强化学习细节)闭源(隐藏思维链)技术平权

开源推动“模型平权”,互联网AI竞争逻辑发生根本变化

DeepSeek的开源策略正在重塑AI产业的竞争逻辑。此前,头部厂商依靠巨额算力投入和闭源模型构建壁垒,后发者在技术追赶上面临巨大资金和时间成本。DeepSeek通过开源强化学习技术,使后发者可以用极低成本(微调成本通常小于预训练1%)在开源模型基础上显著提升模型能力。阶跃星辰Step-2-16K-Exp在Chatbot Arena中位列第11,零一万物Yi-Lightning位列第16,国产大模型整体实力正在快速追赶。在新范式下,预训练不再是互联网企业“All in AI”的唯一解决方案,提高对强化学习的资金投入成为性价比更高的策略。这促使竞争焦点从“谁有更好的模型技术”转向“谁能更好地将AI融入生态和应用”。腾讯(微信超级入口+小程序生态)、阿里巴巴(电商与云计算+苹果合作)、小米(人车家生态+感知数据优势)等拥有生态优势的互联网平台,有望借助DeepSeek开源技术快速提升AI能力,在“模型平权”时代凭借生态和场景构建差异化壁垒。

开源推动AI应用端爆发,2025年成为关键拐点

DeepSeek的开源与低价策略叠加模型能力的大幅提升,正在催化AI应用端的全面爆发。一方面,AI部署成本的大幅度下降使更多企业和开发者可以接入领先模型;另一方面,推理模型处理复杂任务的能力使其成为真正意义上的“效率工具”,产品使用频率和用户规模将大幅提升。OpenAI已证明了Chatbot的商业价值——年化收入约70亿美元,ChatGPT贡献约40亿美元,日活约1.2亿。2025年将是AI应用爆发的一年,具备成熟业务生态的“后发者”有望通过AI赋能升级现有业务,实现“AI+生态”的深度融合。DeepSeek开源带来的“模型平权”使此前在AI技术上相对滞后的企业获得了快速追赶的机会,行业竞争将从“技术军备赛”转向“应用场景赛”。
客服
商务合作
小程序
服务号
折叠