Bawa GPU Anda sendiri. Kami bangun pabrik AI di sekelilingnya.
Beli server NVIDIA GPU Anda dari OEM atau distributor resmi mana pun, kirimkan langsung ke fasilitas Velyrix, dan tim rekayasa kami menangani deployment, jaringan, pendinginan, konfigurasi klaster, pemantauan, serta dukungan berkelanjutan. Tidak ingin memiliki perangkat keras? Sewa klaster kelas yang sama dari armada kami. Bagaimanapun caranya, satu mitra dari dok bongkar muat sampai model berjalan.
Bawa GPU Anda sendiri: Anda membeli perangkat kerasnya, kami menjalankannya selama masih milik Anda
Beli server NVIDIA GPU Anda dari OEM atau distributor resmi mana pun — Dell, Supermicro, GIGABYTE, HPE, Lenovo, atau siapa pun. Kirimkan langsung ke fasilitas kami, dan tim rekayasa kami akan menangani deployment, jaringan, pendinginan, konfigurasi klaster, pemantauan, dan dukungan berkelanjutan. Kami tidak mencari untung dari server Anda. Kami mencari untung dengan menjaganya tetap berjalan.
Bantuan pengadaan opsional tersedia — tinjauan konfigurasi, perbandingan platform netral vendor, dan informasi waktu tunggu yang nyata — tetapi Anda tidak pernah diwajibkan membeli perangkat keras melalui Velyrix, dan harga Anda sama saja.
Sembilan cara bekerja sama dengan Velyrix
Bawa perangkat keras Anda sendiri ke ruang kami, sewa per jam, sewa klaster privat, minta kami membangun dan meng-commissioning seluruh pabrik AI — atau jual semuanya dengan merek Anda sendiri.
Bawa GPU Anda Sendiri
Anda membeli server NVIDIA dari OEM mana pun dan tetap memiliki asetnya. Kami men-deploy, mendinginkan, menjaringkan, memantau, dan mendukungnya — tanpa margin perangkat keras dan tanpa keterikatan.
- OEM atau distributor resmi mana pun
- Instalasi yang menjaga garansi
- Bantuan pengadaan opsional
GPU Cloud
Instans NVIDIA GPU on-demand dan reserved dengan pelatihan multi-node terhubung InfiniBand, Slurm atau Kubernetes, dan penagihan per detik.
- H100, H200, B200, B300 & GB300
- Klaster 8 – 4.096 GPU
- Aktif dalam kurang dari 90 detik
Server GPU Dedikasi
Bare metal single-tenant per bulan atau per tahun. Akses root, tanpa pajak hypervisor, tanpa tetangga berisik, harga terbit yang transparan.
- Node 8×H100 / H200 / B200
- A100, L40S, RTX PRO 6000
- Kontrak 1 – 36 bulan
Kolokasi AI
Bawa sistem HGX, DGX, MGX, atau GPU OEM Anda ke ruang berpendingin cair yang direkayasa untuk rak 40–160 kW.
- Udara, RDHx, dan cair direct-to-chip
- Cage, suite privat, atau grosir
- Remote hands 24×7
Deployment & Commissioning Infrastruktur AI
Pembangunan turnkey: survei lokasi, rack & stack, pengabelan fabric, firmware, burn-in, validasi NCCL, dan uji terima terdokumentasi.
- Penyerahan pabrik AI greenfield
- Pembangunan fabric InfiniBand & Spectrum-X
- Laporan uji terima bertanda tangan
Deployment & Optimalisasi LLM Privat
Endpoint DeepSeek, Qwen, Llama, GPT-OSS, Mistral, GLM, Kimi, MiniMax, Gemma, atau Nemotron milik Anda sendiri — disetel, dikuantisasi, dan siap air-gapped.
- Serving vLLM, SGLang & TensorRT-LLM
- Kuantisasi FP8 / FP4 / AWQ
- Fine-tuning LoRA & RAG
Penyimpanan, Jaringan & Operasi Terkelola
Sistem file paralel, penyimpanan objek, transit 400G, interkoneksi privat, dan NOC 24×7 yang menjalankan klaster untuk Anda.
- Tier WEKA / VAST / Ceph
- Slurm & Kubernetes terkelola
- Observabilitas dan pelaporan SLA
Migrasi, Audit & Siklus Hidup
Pindahkan armada GPU yang sedang berjalan antar ruang atau penyedia, atau minta tim rekayasa independen menjelaskan mengapa klaster Anda saat ini berkinerja di bawah harapan.
- Migrasi bertahap dengan downtime minimal
- Audit kesehatan fabric, firmware & MFU
- Peremajaan dan dekomisioning bersertifikat
Mitra OEM & Channel
Kami adalah bangku deployment dan dukungan di balik perangkat keras yang Anda jual — dengan merek Anda, disertai registrasi peluang dan kebijakan netralitas channel tertulis.
- Deployment white-label & ATP
- Dukungan L1–L3, RMA, dan suku cadang
- Kami tidak pernah menjual ulang server sendiri
Setiap generasi akselerator NVIDIA, dalam satu operator
Dari Ampere untuk inferensi hemat biaya hingga rak Blackwell Ultra untuk pelatihan triliunan parameter, Velyrix menjalankan satu model operasional di seluruh armada — desain fabric yang sama, pemantauan yang sama, SLA yang sama.
- Blackwell Ultra: NVIDIA GB300 NVL72 dan HGX B300 di ruang berpendingin cair direct-to-chip
- Blackwell: Node HGX B200 8-GPU dengan 1,4 TB HBM3e per node
- Hopper: HGX H200 dan H100 SXM dalam skala besar, tersedia hari ini di setiap kawasan
- Ampere & Ada: A100 80GB, L40S, dan RTX PRO 6000 Blackwell untuk inferensi dan visualisasi
Angka daya rak dan node bersifat indikatif untuk perencanaan kapasitas. Konsumsi sebenarnya bergantung pada sasis OEM, metode pendinginan, dan profil beban kerja.
Harga GPU transparan, diterbitkan di muka
Tarif awal untuk kapasitas single-tenant. Klaster reserved multi-node dan kontrak 12–36 bulan ditawarkan secara individual — komitmen lebih besar berada jauh di bawah angka-angka ini.
| Akselerator | Memori | On-demand | Reservasi 6 bulan | Node 8 GPU / bulan | Status |
|---|---|---|---|---|---|
| GB300 NVL72 | 288 GB HBM3e | mulai $8.91 | $8.20 | Skala rak — sesuai penawaran | Q4 2026 |
| B300 SXM | 288 GB HBM3e | mulai $8.34 | $7.67 | mulai $44,800 | Terbatas |
| B200 SXM | 180 GB HBM3e | mulai $6.61 | $6.08 | mulai $38,000 | Tersedia |
| H200 SXM | 141 GB HBM3e | mulai $3.79 | $3.49 | mulai $23,900 | Tersedia |
| H100 SXM | 80 GB HBM3 | mulai $3.10 | $2.85 | mulai $18,400 | Tersedia |
| A100 SXM 80GB | 80 GB HBM2e | mulai $1.90 | $1.75 | mulai $10,400 | Tersedia |
Harga daftar indikatif dalam USD, belum termasuk pajak, berlaku September 2026. Harga bervariasi menurut kawasan, jangka waktu, penyimpanan, dan profil egress, serta dikonfirmasi dalam penawaran tertulis. Lihat daftar harga lengkap.
Jalankan model berbobot terbuka kelas frontier di dalam perimeter Anda sendiri
Velyrix men-deploy, mengkuantisasi, dan mengoptimalkan keluarga model berbobot terbuka terkemuka di perangkat keras Velyrix yang dedikasi, di area kolokasi Anda, atau sepenuhnya air-gapped on-premise — dengan API kompatibel OpenAI dan kriteria uji terima terukur dalam token per detik.
# Your private endpoint — no data leaves your VPC curl https://llm.internal.acme.com/v1/chat/completions \ -H "Authorization: Bearer $VELYRIX_KEY" \ -d '{ "model": "deepseek-v3-fp8", "messages": [{"role":"user","content":"Summarise Q3 risk report"}], "max_tokens": 1024 }' # Served by vLLM on 8x NVIDIA H200 — measured at handover throughput : 14,850 tok/s aggregate ttft_p95 : 218 ms availability: 99.9% monthly SLA
25 pasar di 18 negara — semuanya bebas risiko ekspor
Velyrix hanya menempatkan kapasitas di yurisdiksi tempat akselerator NVIDIA canggih dapat di-deploy secara sah dan tanpa risiko lisensi, di dalam pusat data mitra yang netral operator dan diaudit secara independen. Dua pasar sudah aktif dengan kapasitas yang dipegang hari ini; sisanya disediakan sesuai permintaan terhadap kebutuhan spesifik Anda. Kami memberi tahu mana yang mana sebelum Anda berkomitmen — lihat tabel status lengkap.
"Aktif" berarti Velyrix memegang ruang dan daya yang dikontrak hari ini. "Sesuai permintaan" berarti kami mengontrak ruang sesuai kebutuhan spesifik Anda, menambah sekitar dua hingga enam minggu. "Direncanakan" berarti masih dalam negosiasi — kami tidak akan menerima pesanan atas dasar itu. Setiap pasar dalam daftar ini adalah tujuan yang diizinkan bagi akselerator yang kami deploy, dan setiap pesanan disaring sebelum perangkat keras dikirim; lihat kepatuhan perdagangan dan cara kami memilih negara.
Apa pun yang Anda beli, kami tahu cara men-deploy-nya
Velyrix memegang playbook deployment tervalidasi — elevasi rak, jadwal daya, metode pendinginan, rencana kabel, dan profil uji terima — untuk platform yang benar-benar dikirim pasar.
Juga desain NVIDIA DGX, ASUS, QCT, Wiwynn, dan Foxconn ORv3. Nama platform adalah merek dagang pemiliknya masing-masing, dicantumkan untuk menjelaskan kemampuan deployment. Apakah Anda OEM, distributor, atau reseller? Lihat program mitra kami.
Direkayasa seperti hyperscaler, responsif seperti spesialis
Hitungan minggu, bukan kuartal
Klaster reserved diserahkan dalam 4–8 minggu; kapasitas on-demand aktif dalam hitungan menit. Pabrik AI greenfield di-commissioning dalam 12–20 minggu.
Goodput, bukan sekadar FLOPS
Kami berkontrak atas goodput klaster yang terukur. Setiap serah terima mencakup angka uji terima bandwidth bus NCCL dan MFU berkelanjutan — dan jika kami meleset dari angka yang disepakati, kami memperbaikinya atas biaya kami.
Single tenant sebagai standar
Host dedikasi, partisi fabric dedikasi, kunci enkripsi dipegang pelanggan, dan opsi enklave air-gapped.
Efisien sejak desain
PUE desain 1,15–1,25 dengan pendinginan cair direct-to-chip, pemanfaatan ulang panas bila tersedia, dan kontrak listrik terbarukan.
Kami lebih suka mengisi ruang ini dengan komitmen daripada dengan logo. Jadi inilah yang masuk ke dalam kontrak Anda: kriteria uji terima terukur yang diuji sebelum Anda membayar, kredit layanan yang berlaku otomatis tanpa proses klaim, kontrak bulanan yang tersedia pada hosting BYOG, dan nomor telepon langsung insinyur yang membangun klaster Anda.
Pertanyaan umum
Bisakah saya membawa server GPU yang saya beli sendiri?
Ya - itulah model unggulan kami, Bring Your Own GPU. Beli server NVIDIA GPU dari OEM atau distributor resmi mana pun, kirimkan langsung ke fasilitas Velyrix, dan tim rekayasa kami menangani deployment, jaringan, pendinginan, konfigurasi klaster, pemantauan, dan dukungan berkelanjutan. Anda tetap memegang kepemilikan, garansi, dan hubungan dengan OEM; bantuan pengadaan tersedia tetapi tidak pernah diwajibkan.
Apa itu neocloud, dan apa bedanya Velyrix dengan hyperscaler?
Neocloud adalah penyedia cloud yang dibangun khusus untuk komputasi terakselerasi, bukan TI serbaguna. Velyrix hanya mengoperasikan infrastruktur AI: ruang densitas tinggi berpendingin cair, armada GPU NVIDIA, fabric InfiniBand dan Spectrum-X tanpa kehilangan paket, serta penyimpanan paralel. Fokus itu berarti densitas GPU per rak lebih tinggi, fabric non-blocking sebagai standar, harga yang diterbitkan, dan akses langsung ke insinyur yang membangun klaster Anda.
GPU NVIDIA mana yang bisa saya sewa atau titipkan di Velyrix?
Velyrix mendukung sistem NVIDIA GB300 NVL72, HGX B300, HGX B200, HGX H200, HGX H100, HGX A100, L40S, dan RTX PRO 6000 Blackwell dari OEM utama, tersedia sebagai instans GPU cloud, server bare-metal dedikasi, atau perangkat keras milik pelanggan yang dititipkan di kolokasi Velyrix.
Bisakah saya membawa server GPU sendiri alih-alih menyewa?
Ya. Kolokasi Velyrix direkayasa untuk rak 40-160 kW dengan pendinginan udara, penukar panas pintu belakang, dan cair direct-to-chip, serta menerima sistem HGX, DGX, MGX, dan OCP ORv3 dari Dell, Supermicro, HPE, Lenovo, Gigabyte, QCT, dan lainnya. Kami juga dapat men-deploy dan meng-commissioning perangkat keras itu untuk Anda.
Seberapa cepat sebuah klaster dapat diserahkan?
Instans GPU cloud on-demand mulai berjalan dalam kurang dari 90 detik. Klaster reserved multi-node di ruang yang sudah ada biasanya aktif dalam 4-8 minggu. Pembangunan pabrik AI greenfield, termasuk fabric, pendinginan, dan commissioning, biasanya 12-20 minggu tergantung waktu tunggu perangkat keras.
Apakah Anda membantu men-deploy LLM kami sendiri alih-alih memakai API publik?
Ya. Layanan Deployment dan Optimalisasi LLM Privat kami memasang, mengkuantisasi, mengukur, dan mengoperasikan model berbobot terbuka seperti DeepSeek, Qwen, Llama, OpenAI gpt-oss, Mistral, GLM, Kimi, MiniMax, Gemma, dan NVIDIA Nemotron pada infrastruktur yang Anda kendalikan, diekspos melalui API kompatibel OpenAI dengan target throughput dan latensi yang dikontrakkan.