GPU 你來買,AI 工廠我們替你建
從任何一家授權 OEM 或代理商採購你的 NVIDIA GPU 伺服器,直接發貨到 Velyrix 機房,我們的工程團隊 負責部署、組網、散熱、叢集配置、監控與長期支援。不想持有硬體?也可以直接租用我們機隊裡同級別的叢集。 無論哪種方式,從卸貨平臺到模型跑起來,只對接一個合作方。
BYOG 自帶 GPU:硬體你買,只要你還在用,營運就由我們負責
從任何一家授權 OEM 或代理商採購你的 NVIDIA GPU 伺服器 — Dell、Supermicro、GIGABYTE、 HPE、Lenovo 或其他廠商都可以。直接發貨到我們的機房,我們的工程團隊會負責部署、組網、散熱、叢集配置、 監控與長期支援。我們不靠賣你伺服器賺錢,我們靠幫你把這些伺服器跑好賺錢。
我們提供可選的採購協助 — 配置評審、廠商中立的平臺對比、真實交期 情報 — 但你永遠沒有義務透過 Velyrix 採購硬體,兩種方式下你拿到的價格完全一樣。
與 Velyrix 合作的九種方式
把你自己的硬體放進我們的機房、按小時租用、包下一個私有叢集、讓我們把整個 AI 工廠建好 並完成驗收 — 或者把這一切掛上你自己的品牌來賣。
BYOG 自帶 GPU
NVIDIA 伺服器你從任意 OEM 採購並持有資產,我們負責部署、散熱、組網、監控與支援 — 不賺硬體差價,也沒有捆綁。
- 任意授權 OEM 或代理商
- 不影響原廠保修的安裝規範
- 可選的採購協助
GPU 雲
按需與預留的 NVIDIA GPU 例項,支援 InfiniBand 多節點訓練、Slurm 或 Kubernetes,按秒計費。
- H100、H200、B200、B300 與 GB300
- 8 – 4,096 卡叢集
- 90 秒內開通
獨立 GPU 伺服器
按月或按年的單租戶裸金屬。Root 許可權、無虛擬化損耗、無鄰居干擾、價格公開透明。
- 8×H100 / H200 / B200 節點
- A100、L40S、RTX PRO 6000
- 1 – 36 個月租期
AI 機房託管
把你自有的 HGX、DGX、MGX 或 OEM GPU 系統放進為 40–160 kW 機櫃設計的液冷機房。
- 風冷、背板換熱器與晶片級液冷
- 籠位、獨立套間或批發式機房
- 7×24 現場支援
AI 基礎設施部署與驗收
交鑰匙交付:場地勘察、上架佈線、網路組建、韌體、烤機、NCCL 驗證與書面驗收測試。
- 全新 AI 工廠交付
- InfiniBand 與 Spectrum-X 組網
- 簽署版驗收測試報告
私有大模型部署與最佳化
屬於你自己的 DeepSeek、Qwen、Llama、GPT-OSS、Mistral、GLM、Kimi、MiniMax、Gemma 或 Nemotron 推論端點 — 調優、量化,並支援完全離線。
- vLLM、SGLang 與 TensorRT-LLM
- FP8 / FP4 / AWQ 量化
- LoRA 微調與 RAG
儲存、網路與託管維運
並行檔案系統、物件儲存、400G 出口、雲專線,以及替你把叢集跑起來的 7×24 NOC。
- WEKA / VAST / Ceph 分層
- Slurm 與 Kubernetes 託管
- 可觀測性與 SLA 報告
遷移、審計與生命週期
把在執行的 GPU 機隊在機房或服務商之間搬遷,或者請一支獨立的工程團隊告訴你現有叢集為什麼跑不滿。
- 分階段遷移,儘量不中斷訓練
- 網路、韌體與 MFU 健康審計
- 換代與合規下架
OEM 與渠道合作伙伴
你賣出去的硬體,背後的部署與支援由我們承擔 — 可掛你的品牌,配套專案報備與書面的渠道中立政策。
- 白標部署與驗收報告
- L1–L3 支援、RMA 與備品
- 我們自己從不轉售伺服器
每一代 NVIDIA 加速卡,同一個營運體系
從用於低成本推論的 Ampere,到用於萬億引數訓練的 Blackwell Ultra 整機櫃,Velyrix 對整個機隊 採用同一套營運模型 — 同樣的網路設計、同樣的監控、同樣的 SLA。
- Blackwell Ultra:NVIDIA GB300 NVL72 與 HGX B300,部署於晶片級液冷機房
- Blackwell:HGX B200 八卡節點,單節點 1.4 TB HBM3e
- Hopper:規模化的 HGX H200 與 H100 SXM,所有區域現貨可用
- Ampere 與 Ada:A100 80GB、L40S 與 RTX PRO 6000 Blackwell,用於推論與圖形
以上為容量規劃所用的機櫃與節點功耗參考值。實際功耗取決於 OEM 機箱、散熱方式與業務負載。
價格公開,先看清楚再談
以下為單租戶算力的起步價。多節點預留叢集與 12–36 個月合約單獨報價 — 承諾量越大, 實際價格明顯低於此表。
| 加速卡 | 視訊記憶體 | 按需 | 預留 6 個月 | 八卡節點 / 月 | 狀態 |
|---|---|---|---|---|---|
| GB300 NVL72 | 288 GB HBM3e | $8.91 起 | $8.20 | 整機櫃 — 單獨報價 | 2026 Q4 |
| B300 SXM | 288 GB HBM3e | $8.34 起 | $7.67 | $44,800 起 | 少量 |
| B200 SXM | 180 GB HBM3e | $6.61 起 | $6.08 | $38,000 起 | 現貨 |
| H200 SXM | 141 GB HBM3e | $3.79 起 | $3.49 | $23,900 起 | 現貨 |
| H100 SXM | 80 GB HBM3 | $3.10 起 | $2.85 | $18,400 起 | 現貨 |
| A100 SXM 80GB | 80 GB HBM2e | $1.90 起 | $1.75 | $10,400 起 | 現貨 |
以上為 2026 年 9 月的美元參考標價,不含稅。Velyrix 的標價比市場中位價高 15%, 這部分溢價換來的是無阻塞網路、簽署版驗收報告、四小時硬體更換與凌晨三點也有人接電話的維運團隊。價格隨 區域、租期、儲存與流量方案變化,以書面報價單為準。完整價格見價格頁。
把開源前沿模型跑在你自己的邊界之內
Velyrix 在專屬硬體、你的託管機房,或完全物理隔離的本地環境中,為你部署、量化並最佳化 主流開源權重模型 — 提供相容 OpenAI 介面的 API,並以實測 tokens/s 作為驗收標準。
# 你自己的推論端點 — 資料不出你的 VPC curl https://llm.internal.acme.com/v1/chat/completions \ -H "Authorization: Bearer $VELYRIX_KEY" \ -d '{ "model": "deepseek-v3-fp8", "messages": [{"role":"user","content":"總結第三季度風險報告"}], "max_tokens": 1024 }' # 執行於 8× NVIDIA H200 上的 vLLM — 交付時實測 throughput : 14,850 tok/s 總吞吐 ttft_p95 : 218 ms availability: 99.9% 月度 SLA
不管你買的是哪家,我們都知道怎麼部署
對於市場上真正在出貨的平臺,Velyrix 都有一套經過驗證的部署手冊 — 機櫃立面圖、 配電方案、散熱方式、佈線圖與驗收測試方案。
同時支援 NVIDIA DGX、ASUS、QCT、Wiwynn 與 Foxconn ORv3 設計。上述平臺名稱為各自所有者的 商標,此處僅用於說明我們的部署能力。你是 OEM、代理商或經銷商? 請看我們的合作伙伴計劃。
18 個國家的 25 個市場 — 每一個都沒有出口管制風險
Velyrix 只在「先進 NVIDIA 加速卡可以合法部署、且沒有許可風險」的司法轄區放置算力,機房均為 中立、經獨立審計的合作資料中心。其中兩個市場今天已鎖定容量,其餘按你的具體需求開通。我們會在你做決定 之前說明區別 — 詳見完整狀態表。
"已營運"指 Velyrix 今天已簽下空間與電力;"按需開通"指我們會針對你的具體需求去籤空間, 通常額外需要兩到六週;"計劃中"表示仍在談判,我們不會據此接單。清單上的每一個市場都是我們所部署加速卡的 許可目的地,每一筆訂單在發貨前都會完成篩查,詳見貿易合規與 我們如何挑選國家。
按超大規模資料中心的標準建設,按專業團隊的節奏響應
以周計,而不是以季度計
預留叢集 4–8 周交付;按需算力幾分鐘內可用。全新 AI 工廠 12–20 周完成建設與驗收。
看有效算力,而不只是峰值 FLOPS
我們以實測叢集有效吞吐作為合同指標。每次交付都附帶 NCCL 匯流排頻寬與持續 MFU 驗收資料。
預設單租戶
獨佔主機、獨佔網路分割槽、客戶自持加密金鑰,並可選擇完全物理隔離的專屬區域。
能效優先的設計
目標 PUE 1.15–1.25,採用晶片級液冷,具備條件的機房提供餘熱回收,並以綠電方式簽約。
與其在這裡堆客戶 logo,我們更願意把承諾寫進合同:付款前實測的驗收標準、無需申請即自動生效的 服務賠付、BYOG 託管可按月簽約,以及那位親手建好你叢集的工程師的直撥電話。
常見問題
我可以把自己買的 GPU 伺服器放到你們這裡嗎?
可以,這正是我們的主打模式 BYOG(自帶 GPU)。你從任何一家授權 OEM 或代理商採購 NVIDIA GPU 伺服器,直接發貨到 Velyrix 機房,我們的工程團隊負責部署、組網、散熱、叢集配置、監控與長期支援。硬體所有權、保修與 OEM 關係都留在你手裡;我們也提供可選的採購協助,但絕不強制。
什麼是 neocloud?Velyrix 和超大規模雲有什麼不同?
neocloud 是專為加速計算而生的雲服務商,而不是通用 IT 雲。Velyrix 只做 AI 基礎設施:高密度液冷機房、NVIDIA GPU 機隊、無損 InfiniBand 與 Spectrum-X 網路以及並行儲存。因此我們的單機櫃 GPU 密度更高、預設提供無阻塞網路、價格公開,並且你可以直接聯絡到建設你叢集的那批工程師。
Velyrix 支援哪些 NVIDIA GPU?
包括 NVIDIA GB300 NVL72、HGX B300、HGX B200、HGX H200、HGX H100、HGX A100、L40S 以及 RTX PRO 6000 Blackwell,覆蓋主流 OEM 機型,可作為 GPU 雲例項、獨立裸金屬伺服器,或客戶自有硬體託管在 Velyrix 機房。
叢集多快能交付?
按需 GPU 雲例項 90 秒內啟動。現有機房中的預留多節點叢集通常 4–8 週上線。包含網路、散熱與驗收的全新 AI 工廠建設一般為 12–20 周,主要取決於硬體交期。
你們能幫我們部署自己的大模型嗎?
可以。我們的私有大模型部署與最佳化服務,會在你可控的基礎設施上安裝、量化、基準測試並營運 DeepSeek、Qwen、Llama、OpenAI gpt-oss、Mistral、GLM、Kimi、MiniMax、Gemma 與 NVIDIA Nemotron 等開源權重模型,透過相容 OpenAI 的 API 提供服務,並對吞吐與時延寫入合同。