您的当前位置:首页 > 标签 > AI云服务成本对比
人工智能行业专题(19):从Nebius看新兴云与开源模型Token优化-260724(36页).pdf
AI云服务成本对比:AWS推理TCO贵112%,Nebius自研ODM降本15%|国信证券
国信证券研报显示,AWS推理TCO比Nebius贵112%,H100租赁价格贵57%,Nebius自研ODM机箱节省10-15%OEM溢价,液冷降功耗20%,裸金属+InfiniBand+无搭售构建成本护城河。
 2026-07-27
 AI产业
 36页
27张图表
数据来源:
人工智能行业专题(19):从Nebius看新兴云与开源模型Token优化-260724(36页) 查看报告
国信证券AI云深度报告对Nebius与传统云厂商(AWS、Azure)的成本结构进行了系统对比。Nebius H100按需价格为2.95美元/GPU-hr,比AWS便宜57.1%,比CoreWeave便宜52.0%。AWS微调的TCO比Nebius贵43%,推理TCO贵112%。价差的根源在于三类结构性优势:裸金属去虚拟化消除20-25%性能损耗、自研ODM硬件节省10-15%OEM溢价、无通用云搭售避免200+种服务的成本摊销。新兴AI云正通过硬件自研、编排自控、模型自优化的三层垂直整合,重构AI算力的成本曲线。

价格对比——Nebius H100比AWS便宜57%

根据Opslyft数据,以H100 80GB为例,Nebius按需价格为2.95美元/GPU-hr,比AWS(6.88美元)便宜57.1%,比CoreWeave(6.16美元)便宜52.0%,比Lambda Labs(3.99美元)便宜26.1%。Nebius的可抢占实例仅1.25美元/GPU-hr,比AWS便宜81.8%。Azure H100(Standard_ND96isr_H100_v5)价格为12.29美元/GPU-hr,比Nebius贵78.6%。除价格优势外,Nebius的H100、H200和Blackwell B200可立即按需使用,而AWS p5容量仍需提前数周预订或加入企业折扣计划。Nebius的采购流程更简便,创始人只需一张公司信用卡,即可在几分钟内启动配备8个GPU的节点。AWS同类服务通常需要采购、EDP协商以及长达数月的容量分配谈判。

成本结构解构——裸金属+InfiniBand+无搭售

传统云架构与AI算力集群存在基因冲突。传统云(如AWS、Azure)是为“切分资源”而生,通过虚拟化把一台物理服务器切成100个虚拟机卖给不同客户。而AI算力集群需要的是“聚合资源”——客户往往整租、长周期租赁。虚拟化层Hypervisor拦截GPU command、内存请求、网络包带来的性能损耗率通常在10-15%,AI负载下放大到20-25%。Nebius直接提供裸金属服务器,去除虚拟化软件层。网络方面,大规模训练采用NVIDIA Quantum-2 InfiniBand,基于信用的流控机制保障零丢包、超低延迟。大多数传统云厂商采用RoCE或变种,在标准以太网上“嫁接”RDMA能力,性能不及InfiniBand。此外,在AWS租用带GPU的虚拟机=GPU硬件成本+数据中心成本+S3研发摊销+VPC研发摊销+IAM摊销等200+种服务的分摊。Nebius的内部成本仅为GPU硬件+数据中心+AI云平台,没有为200种服务的开销分摊。

硬件自研——唯一使用定制ODM机箱的新兴云

根据SemiAnalysis,Nebius是唯一一家使用定制ODM机箱的新兴云服务商,同时开发自己的专有固件,避免了会推高故障率和排障开销的继承性设计问题。这些设计共同帮助确保集群保持稳定,工作负载运行无意外中断,维护快速且可预测,预计节省10-15% OEM溢价。液冷方面,Nebius两套冷却系统并存——空气自由冷却(自研)+闭环液冷(NVIDIA设计)。服务器为高封装密度和可预测的功耗行为设计,能够在比现成硬件通常容忍的更宽温度范围内可靠运行。根据公司白皮书,配合创新的冷却布局,将服务器功耗相比标准OEM服务器降低约20%。硬件工程设计能力来自Yandex转移过来的工程师团队,拥有15-20年建设超大规模基础设施的经验,包含能设计数据中心、主板、服务器、机架、连接器、液冷的完整硬件团队。Nebius还与英伟达深度合作,Yandex曾是英伟达在欧洲最大的客户之一,英伟达将向Nebius投资20亿美元。

毛利率对比——从52%升至74%,盈利能力持续提升

Nebius毛利率由2025Q1的52%提升至2026Q1的74%,同比提升22个百分点。毛利率提升的三重驱动:卖方市场下的直接提价叠加GPU利用率拉满(所有投产算力100%售罄,每上线1台GPU有4家以上客户争抢,季度内再次上调算力价格);自有算力占比提升(自研液冷方案使电力成本比竞品低近20%);高附加值软件产品拉高毛利(Token Factory按Token按量计费,单卡Token产出提升2-3倍,软件层边际成本几乎为零)。对比来看,纯算力租赁属于低毛利的IaaS生意,而Token Factory等软件化产品属于高毛利PaaS服务,这是Nebius区别于纯算力租赁商的核心利润增量来源。
Nebius与传统云成本对比
对比维度NebiusAWS价差
H100按需(美元/GPU-hr)2.956.88便宜57.1%
H100可抢占(美元/GPU-hr)1.25
微调TCO基准贵43%
推理TCO基准贵112%
毛利率(26Q1)74%同比+22pct
客服
商务合作
小程序
服务号
折叠