Beranda/Server Dedikasi

Bare metal & server GPU dedikasi

Server GPU single-tenant, harga diterbitkan, tanpa pajak hypervisor

Sewa seluruh mesin — setiap GPU, setiap core, setiap jalur NVMe, termasuk akses root dan BMC. Bulanan, tahunan, atau per jam, di 25 pasar, dengan perangkat keras dari Dell, Supermicro, HPE, Lenovo, GIGABYTE, dan QCT.

Lebih suka memiliki perangkat kerasnya? Beli dari OEM mana pun dan biarkan kami menjalankannya — lihat Bawa GPU Anda Sendiri. Menyewa dan memiliki memakai ruang, fabric, dan insinyur yang sama.

Penyewaan
100% single tenant
Akses
Root + BMC IPMI/Redfish
Jangka waktu
Per jam · 1–36 bulan
Penyediaan
2 jam – 10 hari
Bandwidth
Opsi 10–100G tanpa pengukuran
Node AI unggulan

Server dedikasi NVIDIA HGX & NVL72

Node SXM delapan GPU dengan NVLink dan NVSwitch, CPU dua soket, NIC fabric 400G/800G, dan NVMe scratch lokal. Dijual sebagai node utuh dan sebagai pod multi-node dengan InfiniBand di antaranya.

KonfigurasiCPU / RAMNVMe lokalNIC fabricBulananTahunan (per bulan)Per jam
GB300 NVL72 — 72 GPU36× Grace · 40 TB4× 7.68 TB18× XDR 800GSesuai penawaranSesuai penawaran
8× B300 SXM 288GB2× Xeon 6 / EPYC 9005 · 3 TB8× 7.68 TB Gen58× XDR 800G$44,800$39,900$66.72
8× B200 SXM 180GB2× Xeon 6 / EPYC 9005 · 3 TB8× 7.68 TB Gen58× NDR/XDR$38,000$33,800$52.88
8× H200 SXM 141GB2× Xeon 8568Y+ / EPYC 9554 · 2 TB8× 3.84 TB Gen4/58× NDR 400G$23,900$21,300$30.32
8× H100 SXM 80GB2× Xeon 8468 / EPYC 9474F · 2 TB8× 3.84 TB Gen48× NDR 400G$18,400$16,400$24.80
8× A100 SXM 80GB2× EPYC 7763 / Xeon 8358 · 1 TB4× 3.84 TB Gen48× HDR 200G$10,400$9,300$15.20
8× A100 SXM 40GB2× EPYC 7742 · 1 TB4× 1.92 TB Gen48× HDR 200G$8,000$7,100$11.76

Harga daftar indikatif dalam USD per node, belum termasuk pajak, penyimpanan paralel, dan transit lintas kawasan. Pod multi-node mencakup leaf/spine InfiniBand, pengabelan, dan validasi.

Server PCIe & inferensi

Konfigurasi yang benar-benar disewa pasar

Armada inferensi, fine-tuning, rendering, dan CI jarang membutuhkan NVL72. Inilah konfigurasi andalan, dengan jaminan single-tenant yang sama.

KonfigurasiMemori GPUPlatformBeban kerja umumBulananPer jam
8× H100 NVL 94GB752 GB2× EPYC 9454 · 1.5 TB · PCIe Gen5Inferensi LLM kepadatan tinggi$14,700$21.60
4× H100 PCIe 80GB320 GB2× Xeon 8462Y+ · 768 GBFine-tuning, serving menengah$7,300$10.80
8× RTX PRO 6000 Blackwell 96GB768 GB2× EPYC 9455 · 1.5 TB · Gen5Inferensi, Omniverse, simulasi$9,500$17.44
8× L40S 48GB384 GB2× Xeon 8462Y+ · 1 TBInferensi, video, VDI, rendering$6,000$10.80
4× L40S 48GB192 GB2× EPYC 9354 · 512 GBServing model kecil, batch$3,300$5.40
8× RTX 5090 32GB256 GB2× EPYC 9354 · 768 GBRiset, difusi, klaster pengembangan$3,800$6.00
8× RTX 4090 24GB192 GB2× EPYC 7543 · 512 GBDifusi, CI, inferensi sensitif biaya$2,700$5.04
4× RTX A6000 48GB192 GB2× Xeon 6338 · 512 GBKelas workstation, CAD, CUDA lawas$1,900$5.40
8× L4 24GB192 GB2× EPYC 9124 · 384 GBInferensi hemat daya, transcoding$2,200$3.12
2× L40S 48GB96 GB1× EPYC 9254 · 256 GBNode inferensi entry level$1,640$2.70
Bare metal CPU & penyimpanan

Sisa dari estatnya

Pipeline data, tokenisasi, head node, basis data vektor, dan penyimpanan checkpoint — semuanya di jaringan yang sama, di ruang yang sama dengan GPU Anda.

KonfigurasiCore / threadMemoriPenyimpananJaringanBulanan
Komputasi — EPYC 9654 ganda192C / 384T768 GB DDR52× 3.84 TB NVMe2× 25G$1,490
Komputasi — Xeon 6740E ganda192C / 192T512 GB DDR52× 1.92 TB NVMe2× 25G$1,210
Umum — EPYC 9354 tunggal32C / 64T256 GB DDR52× 1.92 TB NVMe2× 10G$680
Node login16C / 32T128 GB2× 960 GB NVMe2× 10G$370
Penyimpanan — NVMe padat64C / 128T512 GB24× 7.68 TB NVMe (184 TB)2× 100G$3,800
Penyimpanan — kapasitas HDD32C / 64T256 GB60× 22 TB SAS (1.3 PB raw)2× 25G$4,500
Optimal memori96C / 192T3 TB DDR54× 3.84 TB NVMe2× 100G$2,800
Konteks pasar

Di atas median, secara sengaja

Harga daftar Velyrix ditetapkan 15% di atas median pasar — secara sengaja, dan kami menerbitkan hitungannya. Kami tidak berusaha menjadi GPU-jam termurah di internet, karena GPU-jam termurah biasanya kelebihan langganan, blocking, tanpa dukungan, atau ketiganya sekaligus. Premi itu membeli rekayasa: fabric non-blocking, laporan uji terima bertanda tangan, penggantian perangkat keras empat jam, dan insinyur yang menjawab pukul 3 pagi.

Unit sewaRentang pasarMedian pasarHarga Velyrixvs medianYang Anda dapat dari selisihnya
H100 SXM — per GPU-jam$1.90 – $3.50$2.70$3.10+15%Fabric NDR 1:1 non-blocking, tenancy tunggal
H200 SXM — per GPU-jam$2.40 – $4.20$3.30$3.79+15%Kapasitas terjamin, tanpa oversubscription
B200 — per GPU-jam$4.00 – $7.50$5.75$6.61+15%Ruang pendingin cair, clock stabil saat beban penuh
B300 / GB300 — per GPU-jam$5.50 – $9.00$7.25$8.34+15%Commissioning skala rak dan CDU redundan
A100 80GB — per GPU-jam$1.10 – $2.20$1.65$1.90+15%Armada terawat, burn-in sebelum setiap serah terima
L40S — per GPU-jam$0.75 – $1.60$1.18$1.35+15%SLA korporat, bukan best effort
RTX 4090 — per GPU-jam$0.30 – $0.80$0.55$0.63+15%Fasilitas kelas Tier III, bukan rak seadanya
8× H100 SXM 80GB node — per bulan$10,000 – $22,000$16,000$18,400+15%NOC 24×7, penggantian 4 jam, laporan penerimaan
8× H200 SXM 141GB node — per bulan$13,500 – $28,000$20,750$23,900+15%Arsitek khusus, laporan SLA bulanan
8× B200 SXM 180GB node — per bulan$21,000 – $45,000$33,000$38,000+15%Pendinginan direct-to-chip, fabric tervalidasi

Rentang dan median pasar adalah pengamatan Velyrix sendiri atas harga daftar yang diiklankan secara publik oleh penyedia GPU cloud dan bare metal, disediakan hanya sebagai orientasi; itu bukan pernyataan tentang harga terkini pihak ketiga mana pun, dan tidak ada perbandingan yang didukung penyedia lain. Tarif Velyrix adalah harga daftar indikatif yang dikonfirmasi dalam penawaran tertulis. Komitmen multi-tahun dan volume besar ditawarkan secara individual.

Termasuk & opsional

Apa yang menyertai setiap server dedikasi

  • Akses root dan BMC: IPMI/Redfish, media virtual, serial-over-LAN, dan reboot jarak jauh
  • Sistem operasi pilihan Anda: Ubuntu, Rocky, RHEL, Debian, Windows Server, atau image khusus lewat iPXE
  • Tumpukan driver pra-validasi: driver NVIDIA, CUDA, Fabric Manager, DCGM, NVIDIA Container Toolkit
  • Burn-in sebelum serah terima: laporan uji tekan GPU 24–72 jam serta validasi ECC dan termal
  • Bandwidth: 10G tanpa pengukuran atau 25/100G terukur, dual-homed, dengan mitigasi DDoS
  • Remote hands: insinyur fasilitas 24×7 di lokasi, target penggantian perangkat keras empat jam
TambahanSatuanHarga
Sistem file paralel (WEKA/VAST)per TB / bulan$42
Penyimpanan blok NVMeper TB / bulan$100
Penyimpanan objek (API S3)per TB / bulan$20
Backup & snapshotper TB / bulan$14
Uplink 100G tanpa kuotaper port / bulan$1,600
IPv4 /29 tambahanper bulan$46
Interkoneksi cloud privatper 10G / bulan$545
Jaringan InfiniBand podper node / bulan$805
OS terkelola & patchingper server / bulan$230
Slurm / Kubernetes terkelolaper klaster / bulan$2,400
Bicara dengan arsitek infrastruktur AI

GPU milik Anda. Kami yang mengoperasikannya.

Beli server NVIDIA Anda dari OEM atau distributor mana pun, kirim langsung ke fasilitas Velyrix, dan kami menangani sisanya: implementasi, jaringan, pendinginan, pemantauan, dan dukungan. Atau sewa milik kami. Apa pun pilihannya, Anda menerima rencana dalam satu hari kerja.

Pertanyaan umum

Apa beda server GPU dedikasi dengan instans GPU cloud?

Server dedikasi adalah satu mesin fisik utuh yang disewakan kepada satu pelanggan: semua GPU, semua core CPU, semua NVMe, dan BMC menjadi milik Anda selama masa kontrak, tanpa overhead hypervisor dan tanpa penyewaan bersama. Instans cloud disediakan per detik dan bisa tervirtualisasi. Server dedikasi biasanya 25-45 persen lebih murah per GPU-jam pada kontrak tiga bulan atau lebih.

Berapa biaya menyewa server 8x H100 per bulan?

Velyrix mencantumkan node 8x NVIDIA H100 SXM mulai $18.400 per bulan, turun menjadi $16.400 pada kontrak dua belas bulan dan $15.600 pada tiga puluh enam bulan. Harga daftar sengaja 15 persen di atas median pasar sekitar $16.000: itu mencerminkan fabric non-blocking, laporan uji terima bertanda tangan, cakupan NOC 24x7, dan target penggantian perangkat keras empat jam, bukan hosting seadanya.

Bisakah saya menyewa satu GPU saja, bukan satu node utuh?

Ya, melalui Velyrix GPU Cloud, yang menawarkan instans 1, 2, 4, dan 8 GPU ditagih per detik. Server dedikasi dijual sebagai node utuh karena topologi NVLink dan NVSwitch di dalam baseboard HGX tidak dapat dibagi secara bermakna antar penyewa.

Seberapa cepat server dedikasi diserahkan?

Konfigurasi yang tersedia di stok pada kawasan aktif biasanya siap dalam dua hingga dua puluh empat jam. Konfigurasi khusus, pod besar, dan node kelas Blackwell bergantung pada waktu tunggu OEM dan biasanya diserahkan dalam lima hingga dua puluh hari kerja.

Apakah Anda menagih bandwidth atau egress?

Tidak. Paket standar mencakup uplink 10G tanpa pengukuran dan tanpa biaya egress. Port transit berkapasitas lebih besar 25G dan 100G, interkoneksi cloud privat, serta transit dedikasi ditagih sebagai tambahan.

Bisakah saya meningkatkan atau menukar perangkat keras di tengah kontrak?

Ya. Di dalam satu jangka waktu Anda dapat pindah ke tier lebih tinggi dengan membayar selisih tarif, sambil mempertahankan data di penyimpanan yang sama. Penurunan tier berlaku pada tanggal perpanjangan berikutnya.