人工智能行业专题(19):从Nebius看新兴云与开源模型Token优化-260724(36页).pdf

编号:1282130 PDF  PPTX 36页 1.20MB 下载积分:VIP专享
下载报告请您先登录!
以上为报告核心趋势分析,如需获取完整报告详细数据及全部财务模型与估值分析,请访问下载页下载完整PDF报告。FAQ区块。Q1:Nebius与传统云厂商(AWS、Azure)的核心区别是什么?A:传统云是为“切分资源”而生(虚拟化、多租户),AI算力需要“聚合资源”(整租、长周期)。传统云GPU虚拟化hypervisor拦截带来10-15%性能损耗。Nebius提供裸金属服务器、InfiniBand直连、无通用云搭售。比较AWS,AWS微调TCO比Nebius贵43%,推理TCO贵112%。Q2:Token Factory是什么?和AWS Bedrock有什么不同?A:Token Factory是Nebius的托管推理平台,定位是“模型工厂”——把60+个开源模型精加工,将推理成本砍掉最高70%。AWS Bedrock是“模型超市”,聚合模型但不做深度优化。Token Factory的降本来自ODM硬件、Eigen CUDA Kernel、推理调度三层垂直整合的叠加效应。Q3:Eigen AI收购对Nebius的价值是什么?A:2026年5月以约6.43亿美元收购。Eigen拥有AWQ 4-bit量化(MLSys2024最佳论文)和SpAtten稀疏注意力两项核心技术。收购前双方已联合优化DeepSeek、Llama、Qwen等模型,在Artificial Analysis基准上跑出911 tokens/秒的前列成绩。整合后单卡Token吞吐提升2-3倍,单GPU收入提升60%。Q4:Token优化的实际效果如何?A:以Prosus部署Llama-3.3-70B为例,裸金属需1,102张H100完成200B token/天需求,Token Factory仅需244张,客户支出从66,138美元/天降至约23,400美元/天(-65%)。以GLM 5.2部署在B200为例,推理毛利率从30%提升至81%(基础设施优化+54pct,Eigen全开再+27pct)。Q5:开源模型替代闭源模型是否已成为趋势?A:多个案例印证趋势:Revolut因成本失控从闭源全面迁移至Kimi 2.5;Cosine因数据合规将Llama 3.3 70B调教至OpenAI o3水平;Shopify微调Qwen3-32B推理速度2.2倍、成本下降68%;Coinbase形成分层架构,AI支出接近减半。Q6:Nebius的财务状况如何?A:26Q1营收同比飙升684%至3.99亿美元,毛利率74%(25Q1为52%),季末现金储备93亿美元。ARR已突破12.5亿美元,26年全年营收指引30-34亿美元。拥有微软五年174亿美元、Meta五年最高270亿美元超长期合同。数据来源说明。本页面内容基于国信证券于2026年7月24日发布的《人工智能行业专题(19)从Nebius看新兴云与开源模型Token优化》研究报告。报告作者:张伦可(S0980521120004)、陈淑媛(S0980524030003)。数据来源包括公司公告、公司官网、彭博社、SemiAnalysis、Opslyft、Artificial Analysis、X等。核心数据速览: 26Q1营收:3.99亿美元,同比+684%。 26Q1毛利率:74%(25Q1为52%)。 26年全年营收指引:30-34亿美元。 年底ARR目标:70-90亿美元。 签约电力容量:3.5 GW(年底指引4 GW)。 现金储备:93亿美元。 微软合同:五年174亿美元。 Meta合同:五年最高270亿美元。 英伟达投资:20亿美元战略投资。 AWS微调TCO:比Nebius贵43%。 AWS推理TCO:比Nebius贵112%。 H100价格对比:Nebius $2.95/GPU-hr vs AWS $6.88(便宜57.1%)。 ODM定制节省:10-15% OEM溢价。 液冷方案效果:服务器功耗降低约20%。 单GPU收入提升:从$60/天→$96/天(+60%)。 推理毛利率提升:30%→81%(+51pct)。 Eigen收购金额:约6.43亿美元。H2:报告核心数据解读。H3:成本优势——硬件+编排+模型三层垂直整合。Nebius通过ODM硬件自研(节省10-15% OEM溢价)、自研液冷方案(服务器功耗-20%)、弹性打包+双栈调度(回收5-15%闲置算力)、Eigen AI推理优化(单卡吞吐2-3倍)三层叠加,构建成本护城河。AWS微调TCO比Nebius贵43%,推理TCO贵112%。数据来源:国信证券《人工智能行业专题(19)从Nebius看新兴云与开源模型Token优化》(2026年7月24日)。H3:Token Factory——开源模型推理成本降70%。Token Factory靠Eigen优化栈把单卡Token产出提升至2-3倍,单GPU收入从$60/天→$96/天。以GLM 5.2部署B200为例,推理毛利率从30%→81%(+51pct)。多个案例验证:Revolut从闭源迁移至Kimi 2.5、Cosine将Llama 3.3调教至o3水平、Shopify微调Qwen3-32B成本-68%、Coinbase AI支出接近减半。数据来源:国信证券《人工智能行业专题(19)从Nebius看新兴云与开源模型Token优化》(2026年7月24日)。H3:财务高增长——26Q1营收+684%,毛利率74%。26Q1营收3.99亿美元(+684%),毛利率74%(25Q1为52%)。拥有微软174亿美元、Meta 270亿美元超长期合同,英伟达20亿美元战略投资。签约电力容量8个月翻三倍至3.5 GW,26年营收指引30-34亿美元,年底ARR目标70-90亿美元。数据来源:国信证券《人工智能行业专题(19)从Nebius看新兴云与开源模型Token优化》(2026年7月24日)。H2:报告独有数据价值——行业级与公司级颗粒度。 Nebius与传统云架构对比详细数据:报告提供了计算模式、安全隔离、网络通信、存储特征五个维度的传统云(AWS/Azure)与AI优先计算架构的完整对比表。 主要GPU云服务商H100价格对比数据:报告提供了Nebius($2.95)、Lambda($3.99)、Crusoe($3.90)、CoreWeave($6.16)、AWS($6.88)、Azure($12.29)等6家服务商的H100按需价格精确对比。 Nebius AWS TCO对比量化数据:AWS微调TCO比Nebius贵43%,推理TCO贵112%的精确数据。 Nebius四层产品架构详细数据:从裸金属→多租户云→Token Factory→智能代理层四层的计费方式、客户规模、竞争对手的完整数据。 Nebius自研ODM机箱与液冷方案量化数据:节省10-15% OEM溢价、服务器功耗降低约20%的精确数据。 Eigen AI收购详细数据:收购金额约6.43亿美元、AWQ 4-bit量化(MLSys2024最佳论文)、SpAtten稀疏注意力(HPCA最高引论文)、Artificial Analysis基准911 tokens/秒的完整数据。 Token Factory单GPU收入提升详细测算:Llama-3.3-70B案例中H100 TPS从2.1K→9.45K(4.5倍)、GPU数从1,102→244、客户支出从$66,138/天→$23,400/天(-65%)、单GPU日收入从$60→$96(+60%)的完整测算。 GLM 5.2推理毛利率详细测算:原模型30%、Nebius基础设施优化54%(+24pct)、Eigen全开81%(再+27pct)的分步数据,包含TPS、Batch、Prefill时间、Decode时间等完整参数。 Token优化案例完整数据:Revolut(3000万→7000万用户、31亿英镑营收、金融犯罪检测月处理200万任务)、Cosine(Llama 3.3→o3水平)、Nebius自用合规审计($657/30min→$23/12.6min、成本1/29)、Shopify(推理速度2.2倍、成本-68%)、Coinbase(AI支出接近减半)的完整数据。 Nebius财务数据:26Q1营收$399M(+684%)、毛利率74%、ARR$12.5B+、26年营收指引$3.0-3.4B、年底ARR目标$7.0-9.0B、签约电力容量3.5GW、现金储备$9.3B的完整数据。数据来源:国信证券《人工智能行业专题(19)从Nebius看新兴云与开源模型Token优化》(2026年7月24日)。H2:谁需要这份报告? AI基础设施与云计算行业投资者:获取新兴云厂商成本结构、Token推理优化技术路径及开源模型替代闭源模型的经济性分析。 TMT与互联网行业研究员:获取Nebius四层产品架构、与传统云对比数据、收购Eigen AI战略价值及财务预测。 AI应用开发者与企业技术决策者:了解Token Factory的推理优化效果、开源模型后训练能力及实际客户案例。 数据中心与算力产业链投资者:获取Nebius自研ODM硬件、液冷方案、电力容量扩张及IDC布局数据。 大模型与AI Infra研究者:了解Eigen AI的量化与稀疏注意力技术、Token优化对推理毛利率的影响量化数据。FAQ区块。Q1:Nebius与传统云厂商(AWS、Azure)的核心区别是什么?A:传统云为“切分资源”而生,GPU虚拟化hypervisor带来10-15%性能损耗。Nebius提供裸金属服务器、InfiniBand直连、无通用云搭售。AWS微调TCO比Nebius贵43%,推理TCO贵112%。Q2:Token Factory是什么?和AWS Bedrock有什么不同?A:Token Factory是Nebius的托管推理平台,定位“模型工厂”——把60+个开源模型精加工,推理成本降最高70%。AWS Bedrock是“模型超市”,聚合模型但不做深度优化。Token Factory降本来自ODM硬件+Eigen CUDA Kernel+推理调度三层垂直整合。Q3:Eigen AI收购对Nebius的价值是什么?A:约6.43亿美元收购。Eigen拥有AWQ 4-bit量化(MLSys2024最佳论文)和SpAtten稀疏注意力核心技术。整合后单卡Token吞吐提升2-3倍,单GPU收入提升60%($60/天→$96/天)。Q4:Token优化的实际效果如何?A:Prosus部署Llama-3.3-70B:裸金属需1,102张H100,Token Factory仅需244张,客户支出从$66,138/天→$23,400/天(-65%)。GLM 5.2部署B200:推理毛利率从30%→81%(+51pct)。Q5:开源模型替代闭源模型是否已成为趋势?A:多个案例印证:Revolut从闭源迁移至Kimi 2.5;Cosine将Llama 3.3调教至OpenAI o3水平;Shopify微调Qwen3-32B推理速度2.2倍、成本-68%;Coinbase分层架构AI支出接近减半。Q6:Nebius的财务状况如何?A:26Q1营收$399M(+684%),毛利率74%(25Q1为52%)。拥有微软$17.4B、Meta $27B超长期合同,英伟达$2B投资。26年营收指引$3.0-3.4B,年底ARR目标$7.0-9.0B。完整PDF报告包含内容。下载完整PDF报告,您将获得以下全部内容: Nebius公司发展历程、核心管理层背景与股权结构。 Nebius四层产品架构完整数据(裸金属/多租户云/Token Factory/智能代理层)。 传统云(AWS/Azure)与AI优先计算架构五维对比详细数据。 主要GPU云服务商H100价格完整对比(6家服务商)。 Nebius AWS TCO对比量化数据(微调+43%、推理+112%)。 Nebius自研ODM机箱与液冷方案详细技术数据。 Eigen AI收购详情与核心技术(AWQ/SpAtten)解析。 Token Factory推理优化技术原理与定量收益数据。 Prosus部署Llama-3.3-70B完整测算(TPS/GPU数/客户支出/单GPU收入)。 GLM 5.2部署B200推理毛利率分步测算(30%→54%→81%)。 Revolut、Cosine、Nebius自用、Shopify、Coinbase完整案例数据。 开源模型替代闭源模型的经济性趋势分析。 Nebius签约电力容量、数据中心布局与扩张计划。 Nebius 26Q1财务数据与26年全年指引。 微软/Meta超长期合同与英伟达战略投资详情。 宏观经济、下游需求、技术升级、竞争加剧四大风险提示。
友情提示

1、下载报告失败解决办法
2、PDF文件下载后,可能会被浏览器默认打开,此种情况可以点击浏览器菜单,保存网页到桌面,就可以正常下载了。
3、本站不支持迅雷下载,请使用电脑自带的IE浏览器,或者360浏览器、谷歌浏览器下载即可。
4、本站报告下载后的文档和图纸-无水印,预览文档经过压缩,下载后原文更清晰。

本文(人工智能行业专题(19):从Nebius看新兴云与开源模型Token优化-260724(36页).pdf)为本站 (新科技) 主动上传,三个皮匠报告文库仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对上载内容本身不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知三个皮匠报告文库(点击联系客服),我们立即给予删除!

温馨提示:如果因为网速或其他原因下载失败请重新下载,重复下载不扣分。
客服
商务合作
小程序
服务号
折叠