GPU 你来买,AI 工厂我们替你建
从任何一家授权 OEM 或代理商采购你的 NVIDIA GPU 服务器,直接发货到 Velyrix 机房,我们的工程团队 负责部署、组网、散热、集群配置、监控与长期支持。不想持有硬件?也可以直接租用我们机队里同级别的集群。 无论哪种方式,从卸货平台到模型跑起来,只对接一个合作方。
BYOG 自带 GPU:硬件你买,只要你还在用,运营就由我们负责
从任何一家授权 OEM 或代理商采购你的 NVIDIA GPU 服务器 — Dell、Supermicro、GIGABYTE、 HPE、Lenovo 或其他厂商都可以。直接发货到我们的机房,我们的工程团队会负责部署、组网、散热、集群配置、 监控与长期支持。我们不靠卖你服务器赚钱,我们靠帮你把这些服务器跑好赚钱。
我们提供可选的采购协助 — 配置评审、厂商中立的平台对比、真实交期 情报 — 但你永远没有义务通过 Velyrix 采购硬件,两种方式下你拿到的价格完全一样。
与 Velyrix 合作的九种方式
把你自己的硬件放进我们的机房、按小时租用、包下一个私有集群、让我们把整个 AI 工厂建好 并完成验收 — 或者把这一切挂上你自己的品牌来卖。
BYOG 自带 GPU
NVIDIA 服务器你从任意 OEM 采购并持有资产,我们负责部署、散热、组网、监控与支持 — 不赚硬件差价,也没有捆绑。
- 任意授权 OEM 或代理商
- 不影响原厂保修的安装规范
- 可选的采购协助
GPU 云
按需与预留的 NVIDIA GPU 实例,支持 InfiniBand 多节点训练、Slurm 或 Kubernetes,按秒计费。
- H100、H200、B200、B300 与 GB300
- 8 – 4,096 卡集群
- 90 秒内开通
独立 GPU 服务器
按月或按年的单租户裸金属。Root 权限、无虚拟化损耗、无邻居干扰、价格公开透明。
- 8×H100 / H200 / B200 节点
- A100、L40S、RTX PRO 6000
- 1 – 36 个月租期
AI 机房托管
把你自有的 HGX、DGX、MGX 或 OEM GPU 系统放进为 40–160 kW 机柜设计的液冷机房。
- 风冷、背板换热器与芯片级液冷
- 笼位、独立套间或批发式机房
- 7×24 现场支持
AI 基础设施部署与验收
交钥匙交付:场地勘察、上架布线、网络组建、固件、烤机、NCCL 验证与书面验收测试。
- 全新 AI 工厂交付
- InfiniBand 与 Spectrum-X 组网
- 签署版验收测试报告
私有大模型部署与优化
属于你自己的 DeepSeek、Qwen、Llama、GPT-OSS、Mistral、GLM、Kimi、MiniMax、Gemma 或 Nemotron 推理端点 — 调优、量化,并支持完全离线。
- vLLM、SGLang 与 TensorRT-LLM
- FP8 / FP4 / AWQ 量化
- LoRA 微调与 RAG
存储、网络与托管运维
并行文件系统、对象存储、400G 出口、云专线,以及替你把集群跑起来的 7×24 NOC。
- WEKA / VAST / Ceph 分层
- Slurm 与 Kubernetes 托管
- 可观测性与 SLA 报告
迁移、审计与生命周期
把在运行的 GPU 机队在机房或服务商之间搬迁,或者请一支独立的工程团队告诉你现有集群为什么跑不满。
- 分阶段迁移,尽量不中断训练
- 网络、固件与 MFU 健康审计
- 换代与合规下架
OEM 与渠道合作伙伴
你卖出去的硬件,背后的部署与支持由我们承担 — 可挂你的品牌,配套项目报备与书面的渠道中立政策。
- 白标部署与验收报告
- L1–L3 支持、RMA 与备件
- 我们自己从不转售服务器
每一代 NVIDIA 加速卡,同一个运营体系
从用于低成本推理的 Ampere,到用于万亿参数训练的 Blackwell Ultra 整机柜,Velyrix 对整个机队 采用同一套运营模型 — 同样的网络设计、同样的监控、同样的 SLA。
- Blackwell Ultra:NVIDIA GB300 NVL72 与 HGX B300,部署于芯片级液冷机房
- Blackwell:HGX B200 八卡节点,单节点 1.4 TB HBM3e
- Hopper:规模化的 HGX H200 与 H100 SXM,所有区域现货可用
- Ampere 与 Ada:A100 80GB、L40S 与 RTX PRO 6000 Blackwell,用于推理与图形
以上为容量规划所用的机柜与节点功耗参考值。实际功耗取决于 OEM 机箱、散热方式与业务负载。
价格公开,先看清楚再谈
以下为单租户算力的起步价。多节点预留集群与 12–36 个月合约单独报价 — 承诺量越大, 实际价格明显低于此表。
| 加速卡 | 显存 | 按需 | 预留 6 个月 | 八卡节点 / 月 | 状态 |
|---|---|---|---|---|---|
| GB300 NVL72 | 288 GB HBM3e | $8.91 起 | $8.20 | 整机柜 — 单独报价 | 2026 Q4 |
| B300 SXM | 288 GB HBM3e | $8.34 起 | $7.67 | $44,800 起 | 少量 |
| B200 SXM | 180 GB HBM3e | $6.61 起 | $6.08 | $38,000 起 | 现货 |
| H200 SXM | 141 GB HBM3e | $3.79 起 | $3.49 | $23,900 起 | 现货 |
| H100 SXM | 80 GB HBM3 | $3.10 起 | $2.85 | $18,400 起 | 现货 |
| A100 SXM 80GB | 80 GB HBM2e | $1.90 起 | $1.75 | $10,400 起 | 现货 |
以上为 2026 年 9 月的美元参考标价,不含税。Velyrix 的标价比市场中位价高 15%, 这部分溢价换来的是无阻塞网络、签署版验收报告、四小时硬件更换与凌晨三点也有人接电话的运维团队。价格随 区域、租期、存储与流量方案变化,以书面报价单为准。完整价格见价格页。
把开源前沿模型跑在你自己的边界之内
Velyrix 在专属硬件、你的托管机房,或完全物理隔离的本地环境中,为你部署、量化并优化 主流开源权重模型 — 提供兼容 OpenAI 接口的 API,并以实测 tokens/s 作为验收标准。
# 你自己的推理端点 — 数据不出你的 VPC curl https://llm.internal.acme.com/v1/chat/completions \ -H "Authorization: Bearer $VELYRIX_KEY" \ -d '{ "model": "deepseek-v3-fp8", "messages": [{"role":"user","content":"总结第三季度风险报告"}], "max_tokens": 1024 }' # 运行于 8× NVIDIA H200 上的 vLLM — 交付时实测 throughput : 14,850 tok/s 总吞吐 ttft_p95 : 218 ms availability: 99.9% 月度 SLA
不管你买的是哪家,我们都知道怎么部署
对于市场上真正在出货的平台,Velyrix 都有一套经过验证的部署手册 — 机柜立面图、 配电方案、散热方式、布线图与验收测试方案。
同时支持 NVIDIA DGX、ASUS、QCT、Wiwynn 与 Foxconn ORv3 设计。上述平台名称为各自所有者的 商标,此处仅用于说明我们的部署能力。你是 OEM、代理商或经销商? 请看我们的合作伙伴计划。
18 个国家的 25 个市场 — 每一个都没有出口管制风险
Velyrix 只在「先进 NVIDIA 加速卡可以合法部署、且没有许可风险」的司法辖区放置算力,机房均为 中立、经独立审计的合作数据中心。其中两个市场今天已锁定容量,其余按你的具体需求开通。我们会在你做决定 之前说明区别 — 详见完整状态表。
"已运营"指 Velyrix 今天已签下空间与电力;"按需开通"指我们会针对你的具体需求去签空间, 通常额外需要两到六周;"计划中"表示仍在谈判,我们不会据此接单。清单上的每一个市场都是我们所部署加速卡的 许可目的地,每一笔订单在发货前都会完成筛查,详见贸易合规与 我们如何挑选国家。
按超大规模数据中心的标准建设,按专业团队的节奏响应
以周计,而不是以季度计
预留集群 4–8 周交付;按需算力几分钟内可用。全新 AI 工厂 12–20 周完成建设与验收。
看有效算力,而不只是峰值 FLOPS
我们以实测集群有效吞吐作为合同指标。每次交付都附带 NCCL 总线带宽与持续 MFU 验收数据。
默认单租户
独占主机、独占网络分区、客户自持加密密钥,并可选择完全物理隔离的专属区域。
能效优先的设计
目标 PUE 1.15–1.25,采用芯片级液冷,具备条件的机房提供余热回收,并以绿电方式签约。
与其在这里堆客户 logo,我们更愿意把承诺写进合同:付款前实测的验收标准、无需申请即自动生效的 服务赔付、BYOG 托管可按月签约,以及那位亲手建好你集群的工程师的直拨电话。
常见问题
我可以把自己买的 GPU 服务器放到你们这里吗?
可以,这正是我们的主打模式 BYOG(自带 GPU)。你从任何一家授权 OEM 或代理商采购 NVIDIA GPU 服务器,直接发货到 Velyrix 机房,我们的工程团队负责部署、组网、散热、集群配置、监控与长期支持。硬件所有权、保修与 OEM 关系都留在你手里;我们也提供可选的采购协助,但绝不强制。
什么是 neocloud?Velyrix 和超大规模云有什么不同?
neocloud 是专为加速计算而生的云服务商,而不是通用 IT 云。Velyrix 只做 AI 基础设施:高密度液冷机房、NVIDIA GPU 机队、无损 InfiniBand 与 Spectrum-X 网络以及并行存储。因此我们的单机柜 GPU 密度更高、默认提供无阻塞网络、价格公开,并且你可以直接联系到建设你集群的那批工程师。
Velyrix 支持哪些 NVIDIA GPU?
包括 NVIDIA GB300 NVL72、HGX B300、HGX B200、HGX H200、HGX H100、HGX A100、L40S 以及 RTX PRO 6000 Blackwell,覆盖主流 OEM 机型,可作为 GPU 云实例、独立裸金属服务器,或客户自有硬件托管在 Velyrix 机房。
集群多快能交付?
按需 GPU 云实例 90 秒内启动。现有机房中的预留多节点集群通常 4–8 周上线。包含网络、散热与验收的全新 AI 工厂建设一般为 12–20 周,主要取决于硬件交期。
你们能帮我们部署自己的大模型吗?
可以。我们的私有大模型部署与优化服务,会在你可控的基础设施上安装、量化、基准测试并运营 DeepSeek、Qwen、Llama、OpenAI gpt-oss、Mistral、GLM、Kimi、MiniMax、Gemma 与 NVIDIA Nemotron 等开源权重模型,通过兼容 OpenAI 的 API 提供服务,并对吞吐与时延写入合同。