跳到主要内容
Vantaige
Nebius screenshot
Nebius logo

Nebius

付费

Nebius 是一家在纳斯达克上市的 AI 云服务提供商,提供大规模 NVIDIA GPU 计算资源以及针对开源模型的 Token Factory 推理 API。欧盟数据驻留、企业级治理以及 NVIDIA 的投资,使其成为模型训练和生产推理的可靠选择。

功能:API

Nebius 是一家全栈 AI 云公司,在纳斯达克上市(股票代码:NBIS),总部位于阿姆斯特丹。该公司出租大规模 NVIDIA GPU 计算资源,并在其上运行托管推理 API。它并非传统意义上的初创公司。它脱胎于 2024 年 Yandex N.V. 的重组,保留了约 1,300 名工程师、一个芬兰数据中心以及 AI 知识产权,剥离了所有俄罗斯资产,并于 2024 年 10 月以 Nebius Group 的名义恢复在纳斯达克交易。它解决的问题非常直接:AI 实验室和企业需要 NVIDIA 级别的集群来进行训练和推理,但又不想自建数据中心。Nebius 以托管云的形式提供了这一服务,从按小时计费的裸机 GPU 到按 Token 计费的 API 端点一应俱全,客户无需费心管理 Kubernetes 或节点健康状况。

其产品分为三个层级。Nebius AI Cloud 提供裸机 GPU 计算,配备基于 InfiniBand 连接机箱的 H100、H200、B200 和 B300 实例,并免费提供托管的 Kubernetes 和 Slurm。Token Factory 于 2025 年 11 月推出,是一个兼容 OpenAI 的推理 API,支持包括 DeepSeek、Llama 和 Qwen 在内的 60 多种开源模型,提供专用端点、99.9% 的 SLA 以及一键微调功能。Aether 是企业治理层,增加了 SOC 2 Type II、ISO 27001 认证以及欧盟数据驻留。NVIDIA 在 2026 年 3 月承诺了 $2 billion 的战略投资,此外 Nebius 还与 Meta 和 Microsoft 达成了价值数十亿美元的算力协议。

Nebius 在 2026 年 6 月的实际产品矩阵

可以将 Nebius 视为通往同一基础设施的两扇大门。第一扇门是裸机计算:通过 InfiniBand 连接的非虚拟化 GPU 实例,支持按需或抢占式计费,并免费包含托管的 Kubernetes、Slurm 和存储。这是运行预训练、大规模微调和自定义分布式工作负载的理想场所。第二扇门是 Token Factory,即托管推理 API,它能让开发者在几分钟内完成从选择模型到部署生产端点的全过程,而无需像裸机计算那样耗费整个下午进行设置。它按 Token 计费,没有 GPU 闲置成本,可自动扩展以应对海量请求,并在欧盟和美国区域提供零保留推理服务。企业背景在这里至关重要,因为基础设施是一项长期投资:NVIDIA 在 2026 年 3 月的 $2 billion 投资、与 Meta 达成的 $27 billion 协议,以及与 Microsoft 价值高达 $19.4 billion 的交易,为 Nebius 带来了约 $45 billion 的合同储备和可靠的发展前景,这让任何将训练管道托付给它的客户都感到安心。

Nebius 与 CoreWeave 及 Together AI 的对比

CoreWeave 是其最接近的 GPU 云同行,两者的差异是结构性的。双方都提供 H100、H200 和 B200,但 Nebius 强调通过定制 ODM 机箱来降低总拥有成本,并且至关重要的是,它捆绑了 CoreWeave 所不具备的托管推理 API(Token Factory)。CoreWeave 在北美和欧洲拥有更大的业务版图,并依赖于超大规模云服务商的多年合同;而 Nebius 则提供完全自助的按小时计费 GPU,无最低消费承诺,并且在 CoreWeave 出现巨额亏损的 2025 年实现了盈利。与 Together AI 相比,反差在于基础设施的深度:Together 主要是一个带有可选专用端点的推理 API,而 Nebius 拥有物理数据中心,可以通过一个账户同时提供训练级的多节点集群和推理服务,并明确提供以美国为中心的 Together 所不强调的欧盟数据驻留。对于受 GDPR 管辖的欧洲团队来说,数据驻留往往是决定性因素,而较轻的 GPU 需求也可以通过 Crusoe 或 RunPod 等实时替代方案来满足。

GPU 云与 Token Factory 的定价

GPU 定价透明且极具竞争力:H100 按需计费为每小时 $3.85,抢占式为 $2.15;H200 分别为 $4.50 或 $2.45;B200 分别为 $7.15 或 $3.95。对于数月的长期承诺,预留集群可享受高达 35% 的折扣。Token Factory 推理的起步价约为每百万 Token $0.08(适用于小型模型),高级模型最高约为 $1.93,并提供批处理折扣和重复上下文的大额缓存节省。没有免费的 GPU 试用,最低充值 $25 即可激活计费。

“通过利用专用端点,我们获得了有保障的性能。自动扩展功能彻底改变了游戏规则,使我们能够在无需人工干预的情况下每天处理 200 billion 个 Token。”—— Prosus AI 总监 Zulkuf Genc,2025 年 11 月。

平台提供额度支持,但需要申请而非开放获取:NVIDIA Inception 初创公司可通过 AI Lift 计划申请高达 $150,000 的额度,学术研究人员可申请资助。对于大多数团队来说,入门方式只需充值并按小时或按 Token 计费即可。

在 Nebius 上运行的痛点

最常被提及的痛点是意外账单。平台没有统一的账户暂停按钮或自动闲置关机功能,因此未关闭的资源会悄无声息地产生费用。如果你忘记删除每一个虚拟机、磁盘和存储桶,一个晚上的实验可能会变成长达数月的账单。平台自身的设计风格也容易导致这种情况。

“这个界面给人的感觉是为‘先部署,后优化’而设计的。”—— Automateed 评论,2026 年。

除了计费问题,Nebius 承认其最新的 B300 硬件在 2025 年中旬之前稳定性欠佳(当时正在推出自动修复改进);自助支持的响应时间为 24 到 48 小时,落后于超大规模云服务商;边缘功能的文档不如 AWS 和 GCP 完善;截至 2026 年中旬,尚未设立亚太区域,这对于需要低延迟的亚太工作负载来说是一个硬性阻碍,而不仅仅是偏好问题。

Nebius 适合谁,不适合谁

Nebius 非常适合需要符合 GDPR 且具备真实数据驻留的推理服务的欧盟团队;适合在 InfiniBand 集群上运行多节点训练或大规模微调的 AI 实验室;适合希望由同一供应商同时提供训练算力和生产推理 API 的团队;以及需要 SOC 2 Type II、ISO 27001 或 HIPAA 合规性的企业。符合 AI Lift 额度申请条件的 NVIDIA Inception 初创公司将获得丰厚的起步支持。

它不适合需要亚太区域覆盖的团队;不适合可能不会主动监控和关闭资源的初学者;不适合需要 GPT 或 Claude 等专有基础模型的工作负载(Token Factory 仅支持开源模型);也不适合那些希望获得超大规模云服务商那样深厚的社区、教程和成熟文档的用户。该产品功能强大,但在细节方面仍处于成熟过程中。

用户评价

暂无评价,快来分享你的第一条体验吧!

登录 后即可撰写评价。

相关文章

与 Nebius 相关的指南和文章。