Accueil/Serveurs dédiés

Bare metal et serveurs GPU dédiés

Serveurs GPU mono-locataires, tarifs publiés, sans surcoût d'hyperviseur

Louez une machine entière — chaque GPU, chaque cœur, chaque voie NVMe, accès root et BMC inclus. Au mois, à l'année ou à l'heure, sur 25 marchés, avec du matériel Dell, Supermicro, HPE, Lenovo, GIGABYTE et QCT.

Vous préférez posséder le matériel ? Achetez-le chez n'importe quel OEM et laissez-nous l'exploiter — voir Apportez vos GPU. Louer et posséder utilisent les mêmes salles, le même fabric et les mêmes ingénieurs.

Locataire
100% mono-locataire
Accès
Root + BMC IPMI/Redfish
Durées
À l'heure · 1 à 36 mois
Provisionnement
2 heures à 10 jours
Bande passante
Options 10 à 100G non comptées
Nœuds IA phares

Serveurs dédiés NVIDIA HGX et NVL72

Nœuds SXM à huit GPU avec NVLink et NVSwitch, CPU bi-socket, NIC de fabric 400G/800G et NVMe local. Vendus en nœuds complets et en pods multinœuds reliés en InfiniBand.

ConfigurationCPU / RAMNVMe localCarte fabricMensuelAnnuel (par mois)Horaire
GB300 NVL72 — 72 GPU36× Grace · 40 TB4× 7.68 TB18× XDR 800GSur devisSur devis
8× B300 SXM 288GB2× Xeon 6 / EPYC 9005 · 3 TB8× 7.68 TB Gen58× XDR 800G$44,800$39,900$66.72
8× B200 SXM 180GB2× Xeon 6 / EPYC 9005 · 3 TB8× 7.68 TB Gen58× NDR/XDR$38,000$33,800$52.88
8× H200 SXM 141GB2× Xeon 8568Y+ / EPYC 9554 · 2 TB8× 3.84 TB Gen4/58× NDR 400G$23,900$21,300$30.32
8× H100 SXM 80GB2× Xeon 8468 / EPYC 9474F · 2 TB8× 3.84 TB Gen48× NDR 400G$18,400$16,400$24.80
8× A100 SXM 80GB2× EPYC 7763 / Xeon 8358 · 1 TB4× 3.84 TB Gen48× HDR 200G$10,400$9,300$15.20
8× A100 SXM 40GB2× EPYC 7742 · 1 TB4× 1.92 TB Gen48× HDR 200G$8,000$7,100$11.76

Tarifs de liste indicatifs en USD par nœud, hors taxes, stockage parallèle et transit inter-régions. Les pods multinœuds incluent le leaf/spine InfiniBand, le câblage et la validation.

Serveurs PCIe et d'inférence

Les configurations que le marché loue vraiment

Les parcs d'inférence, de fine-tuning, de rendu et de CI ont rarement besoin d'un NVL72. Voici les configurations de travail, avec la même garantie de mono-location.

ConfigurationMémoire GPUPlateformeCharge typeMensuelHoraire
8× H100 NVL 94GB752 GB2× EPYC 9454 · 1.5 TB · PCIe Gen5Inférence LLM haute densité$14,700$21.60
4× H100 PCIe 80GB320 GB2× Xeon 8462Y+ · 768 GBFine-tuning, service de taille moyenne$7,300$10.80
8× RTX PRO 6000 Blackwell 96GB768 GB2× EPYC 9455 · 1.5 TB · Gen5Inférence, Omniverse, simulation$9,500$17.44
8× L40S 48GB384 GB2× Xeon 8462Y+ · 1 TBInférence, vidéo, VDI, rendu$6,000$10.80
4× L40S 48GB192 GB2× EPYC 9354 · 512 GBService de petits modèles, lots$3,300$5.40
8× RTX 5090 32GB256 GB2× EPYC 9354 · 768 GBRecherche, diffusion, clusters de développement$3,800$6.00
8× RTX 4090 24GB192 GB2× EPYC 7543 · 512 GBDiffusion, CI, inférence sensible au coût$2,700$5.04
4× RTX A6000 48GB192 GB2× Xeon 6338 · 512 GBClasse station de travail, CAO, CUDA ancien$1,900$5.40
8× L4 24GB192 GB2× EPYC 9124 · 384 GBInférence basse consommation, transcodage$2,200$3.12
2× L40S 48GB96 GB1× EPYC 9254 · 256 GBNœud d'inférence d'entrée$1,640$2.70
Bare metal CPU et stockage

Le reste du parc

Pipelines de données, tokenisation, nœuds de connexion, bases vectorielles et stockage de checkpoints — le tout sur le même réseau, dans la même salle que vos GPU.

ConfigurationCœurs / threadsMémoireStockageRéseauMensuel
Calcul — Double EPYC 9654192C / 384T768 GB DDR52× 3.84 TB NVMe2× 25G$1,490
Calcul — Double Xeon 6740E192C / 192T512 GB DDR52× 1.92 TB NVMe2× 25G$1,210
Généraliste — EPYC 9354 simple32C / 64T256 GB DDR52× 1.92 TB NVMe2× 10G$680
Nœud de connexion16C / 32T128 GB2× 960 GB NVMe2× 10G$370
Stockage — NVMe dense64C / 128T512 GB24× 7.68 TB NVMe (184 TB)2× 100G$3,800
Stockage — capacité HDD32C / 64T256 GB60× 22 TB SAS (1.3 PB raw)2× 25G$4,500
Optimisé mémoire96C / 192T3 TB DDR54× 3.84 TB NVMe2× 100G$2,800
Contexte de marché

Au-dessus de la médiane, délibérément

Le tarif de liste Velyrix est fixé 15% au-dessus de la médiane du marché — délibérément, et nous publions le calcul. Nous ne cherchons pas à être la GPU-heure la moins chère d'internet, parce que la GPU-heure la moins chère est généralement survendue, bloquante, sans support, ou les trois. Le supplément paie de l'ingénierie : fabric non bloquant, rapport de recette signé, remplacement matériel en quatre heures et des ingénieurs qui répondent à 3 heures du matin.

Unité de locationFourchette marchéMédiane marchéTarif Velyrixvs médianeCe que la prime finance
H100 SXM — par GPU-heure$1.90 – $3.50$2.70$3.10+15%Fabric NDR 1:1 non bloquant, mono-locataire
H200 SXM — par GPU-heure$2.40 – $4.20$3.30$3.79+15%Capacité garantie, sans surréservation
B200 — par GPU-heure$4.00 – $7.50$5.75$6.61+15%Salles refroidies à l'eau, fréquences soutenues
B300 / GB300 — par GPU-heure$5.50 – $9.00$7.25$8.34+15%Mise en service à l'échelle rack, CDU redondants
A100 80GB — par GPU-heure$1.10 – $2.20$1.65$1.90+15%Parc entretenu, burn-in avant chaque livraison
L40S — par GPU-heure$0.75 – $1.60$1.18$1.35+15%SLA entreprise plutôt que best effort
RTX 4090 — par GPU-heure$0.30 – $0.80$0.55$0.63+15%Site classe Tier III, pas une étagère
8× H100 SXM 80GB nœud — par mois$10,000 – $22,000$16,000$18,400+15%NOC 24×7, remplacement en 4 h, rapport de recette
8× H200 SXM 141GB nœud — par mois$13,500 – $28,000$20,750$23,900+15%Architecte dédié, rapport SLA mensuel
8× B200 SXM 180GB nœud — par mois$21,000 – $45,000$33,000$38,000+15%Refroidissement direct au chip, fabric validé

Les fourchettes et médianes de marché sont des observations propres à Velyrix sur les tarifs de liste publiés par des fournisseurs de cloud GPU et de bare metal, fournies à titre indicatif uniquement ; elles ne constituent pas une affirmation sur les prix actuels d'un tiers, et aucun comparatif n'est approuvé par un autre fournisseur. Les tarifs Velyrix sont des prix de liste indicatifs confirmés dans un devis écrit. Les engagements pluriannuels et les gros volumes font l'objet de devis individuels.

Inclus et en option

Ce qui accompagne chaque serveur dédié

  • Accès root et BMC : IPMI/Redfish, médias virtuels, série sur LAN et redémarrage à distance
  • Le système d'exploitation de votre choix : Ubuntu, Rocky, RHEL, Debian, Windows Server ou une image personnalisée via iPXE
  • Pile de pilotes pré-validée : pilote NVIDIA, CUDA, Fabric Manager, DCGM, NVIDIA Container Toolkit
  • Burn-in avant livraison : rapport de stress GPU de 24 à 72 heures et validation ECC et thermique
  • Bande passante : 10G non comptés ou 25/100G comptés, double raccordement, avec mitigation DDoS
  • Interventions sur site : ingénieurs du site 24×7 et objectif de remplacement matériel en quatre heures
OptionUnitéPrix
Système de fichiers parallèle (WEKA/VAST)par To / mois$42
Stockage bloc NVMepar To / mois$100
Stockage objet (API S3)par To / mois$20
Sauvegardes et snapshotspar To / mois$14
Lien 100G non comptépar port / mois$1,600
IPv4 /29 supplémentairepar mois$46
Interconnexion cloud privéepar 10G / mois$545
Réseau InfiniBand du podpar nœud / mois$805
OS infogéré et correctifspar serveur / mois$230
Slurm / Kubernetes infogéréspar cluster / mois$2,400
Échangez avec un architecte d'infrastructure IA

Les GPU sont à vous. Nous les exploitons.

Achetez vos serveurs NVIDIA auprès de l'OEM ou du distributeur de votre choix, expédiez-les vers un centre de données Velyrix et nous nous occupons du reste : déploiement, réseau, refroidissement, supervision et support. Ou louez les nôtres. Dans les deux cas, vous recevez un plan sous un jour ouvré.

Questions fréquentes

Quelle différence entre un serveur GPU dédié et une instance de cloud GPU ?

Un serveur dédié est une machine physique entière louée à un seul client : tous les GPU, tous les cœurs CPU, tous les NVMe et le BMC vous appartiennent pendant la durée, sans surcoût d'hyperviseur ni location partagée. Une instance cloud est provisionnée à la seconde et peut être virtualisée. Les serveurs dédiés reviennent généralement 25 à 45 pour cent moins cher par GPU-heure sur des durées de trois mois ou plus.

Combien coûte la location d'un serveur 8x H100 par mois ?

Velyrix affiche un nœud 8x NVIDIA H100 SXM à partir de 18 400 $ par mois, 16 400 $ sur douze mois et 15 600 $ sur trente-six mois. Le tarif de liste est délibérément 15 pour cent au-dessus de la médiane du marché d'environ 16 000 $ : il reflète un fabric non bloquant, un rapport de recette signé, une couverture NOC 24x7 et un objectif de remplacement matériel en quatre heures, plutôt qu'un hébergement au mieux.

Puis-je louer un seul GPU plutôt qu'un nœud entier ?

Oui, via le cloud GPU Velyrix, qui propose des instances de 1, 2, 4 et 8 GPU facturées à la seconde. Les serveurs dédiés sont vendus en nœuds complets car la topologie NVLink et NVSwitch d'une carte de base HGX ne peut pas être divisée raisonnablement entre locataires.

Dans quel délai un serveur dédié est-il livré ?

Les configurations en stock dans une région active sont généralement actives sous deux à vingt-quatre heures. Les configurations sur mesure, les grands pods et les nœuds de classe Blackwell dépendent des délais OEM et sont normalement livrés sous cinq à vingt jours ouvrés.

Facturez-vous la bande passante ou le trafic sortant ?

Non. Les offres standard incluent un lien 10G non compté sans frais de sortie. Les ports de transit dédiés de plus grande capacité en 25G et 100G et les interconnexions cloud privées sont facturés en option.

Puis-je changer ou faire évoluer le matériel en cours de contrat ?

Oui. Pendant une durée, vous pouvez passer à un niveau supérieur en payant la différence de tarif, en conservant vos données sur le même stockage. Les passages à un niveau inférieur s'appliquent à la date de renouvellement suivante.