Apportez vos GPU  achetez chez n'importe quel OEM · expédiez-nous · nous exploitons

Apportez vos propres GPU. Nous construisons l'usine IA autour d'eux.

Achetez vos serveurs NVIDIA GPU auprès de n'importe quel OEM ou distributeur agréé, expédiez-les directement vers un site Velyrix, et notre équipe d'ingénierie prend en charge le déploiement, le réseau, le refroidissement, la configuration du cluster, la supervision et le support continu. Vous préférez ne pas posséder le matériel ? Louez la même classe de cluster dans notre parc. Dans les deux cas, un seul interlocuteur du quai de déchargement au modèle en production.

0%Marge sur le matériel que vous achetez vous-même
72 hBurn-in et recette signée avant la livraison
15 minRéponse P1 contractuelle, 24×7
3.2 Tb/sInfiniBand XDR non bloquant par nœud
NVIDIA HGX B300GB300 NVL72HGX B200HGX H200HGX H100 Quantum-X800 InfiniBandEthernet Spectrum-XBlueField-3 DPU Refroidissement liquide direct au chipSlurm et KubernetesvLLM / SGLang / TensorRT-LLM Stockage parallèle WEKA et VASTOCP ORv3
Notre plus grand atout — le BYOG

Apportez vos GPU : vous achetez le matériel, nous l'exploitons aussi longtemps qu'il vous appartient

Achetez vos serveurs NVIDIA GPU auprès de n'importe quel OEM ou distributeur agréé — Dell, Supermicro, GIGABYTE, HPE, Lenovo ou un autre. Expédiez-les directement vers notre site, et notre équipe d'ingénierie prendra en charge le déploiement, le réseau, le refroidissement, la configuration du cluster, la supervision et le support continu. Nous ne gagnons pas d'argent sur vos serveurs. Nous gagnons de l'argent en les maintenant en marche.

Achetez chez n'importe quel OEMVotre fournisseur, votre grille tarifaire, votre garantie. Aucun achat via nous n'est requis.
Expédiez-le-nousLe fret arrive directement à notre quai. Nous réceptionnons, inspectons, photographions et enregistrons chaque numéro de série.
Nous déployonsBaie, énergie, refroidissement liquide ou à air, câblage structuré et fabric optimisé par rail.
Nous validonsLigne de base firmware, burn-in de 72 heures, benchmarks NCCL, rapport de recette signé.
Nous exploitonsNOC 24×7, supervision, gestion des RMA avec votre OEM, pièces et cycle de vie.

Une assistance à l'achat est disponible — revue de configuration, comparatif de plateformes neutre et informations réelles sur les délais — mais vous n'êtes jamais obligé d'acheter du matériel via Velyrix, et votre tarif est identique dans les deux cas.

Infrastructure IA complète

Neuf façons de travailler avec Velyrix

Apportez votre matériel dans nos salles, louez à l'heure, réservez un cluster privé, confiez-nous la construction et la recette de toute l'usine IA — ou revendez l'ensemble sous votre propre marque.

📦

Apportez vos GPU

Vous achetez les serveurs NVIDIA chez n'importe quel OEM et conservez l'actif. Nous les déployons, les refroidissons, les connectons, les supervisons et les supportons — sans marge sur le matériel et sans verrouillage.

  • N'importe quel OEM ou distributeur agréé
  • Installation préservant la garantie
  • Assistance à l'achat en option
Découvrir le BYOG →

Cloud GPU

Instances NVIDIA GPU à la demande et réservées, avec entraînement multinœud connecté en InfiniBand, Slurm ou Kubernetes, et facturation à la seconde.

  • H100, H200, B200, B300 et GB300
  • Clusters de 8 à 4 096 GPU
  • Démarrage en moins de 90 secondes
Découvrir le cloud GPU →

Serveurs GPU dédiés

Bare metal mono-locataire au mois ou à l'année. Accès root, pas de surcoût d'hyperviseur, pas de voisins bruyants, tarifs publiés en toute transparence.

  • Nœuds 8×H100 / H200 / B200
  • A100, L40S, RTX PRO 6000
  • Contrats de 1 à 36 mois
Voir serveurs et tarifs →

Colocation IA

Apportez vos systèmes HGX, DGX, MGX ou GPU OEM dans des salles refroidies à l'eau conçues pour des baies de 40 à 160 kW.

  • Air, RDHx et liquide direct au chip
  • Cage, salle privée ou wholesale
  • Interventions sur site 24×7
Découvrir la colocation →

Déploiement et mise en service d'infrastructure IA

Construction clés en main : étude de site, montage en baie, câblage du fabric, firmware, burn-in, validation NCCL et recette documentée.

  • Livraison d'usines IA neuves
  • Construction de fabric InfiniBand et Spectrum-X
  • Rapports de recette signés
Voir le programme de déploiement →

Déploiement et optimisation de LLM privés

Votre propre endpoint DeepSeek, Qwen, Llama, GPT-OSS, Mistral, GLM, Kimi, MiniMax, Gemma ou Nemotron — réglé, quantifié et compatible environnement isolé.

  • Service via vLLM, SGLang et TensorRT-LLM
  • Quantification FP8 / FP4 / AWQ
  • Fine-tuning LoRA et RAG
Déployer un modèle privé →

Stockage, réseau et exploitation infogérée

Systèmes de fichiers parallèles, stockage objet, transit 400G, interconnexion privée et un NOC 24×7 qui exploite le cluster pour vous.

  • Niveaux WEKA / VAST / Ceph
  • Slurm et Kubernetes infogérés
  • Observabilité et rapports SLA
Découvrir la plateforme →

Migration, audit et cycle de vie

Déplacez un parc GPU en production entre salles ou fournisseurs, ou faites-vous expliquer par une équipe d'ingénierie indépendante pourquoi votre cluster actuel sous-performe.

  • Migration par phases avec interruption minimale
  • Audit fabric, firmware et MFU
  • Renouvellement et mise hors service certifiée
Voir les services de cycle de vie →
🤝

Partenaires OEM et canal

Nous sommes l'équipe de déploiement et de support derrière le matériel que vous vendez — sous votre marque, avec enregistrement d'affaire et une politique écrite de neutralité de canal.

  • Déploiement en marque blanche et recette
  • Support L1–L3, RMA et pièces
  • Nous ne revendons jamais de serveurs nous-mêmes
Programme partenaires →
Le parc Velyrix

Toutes les générations d'accélérateurs NVIDIA, chez un seul opérateur

D'Ampere pour l'inférence optimisée en coût aux baies Blackwell Ultra pour l'entraînement à mille milliards de paramètres, Velyrix applique un modèle d'exploitation unique à tout le parc : la même conception de fabric, la même supervision, le même SLA.

  • Blackwell Ultra : NVIDIA GB300 NVL72 et HGX B300 dans des salles refroidies par liquide direct au chip
  • Blackwell : Nœuds HGX B200 de 8 GPU avec 1,4 To de HBM3e par nœud
  • Hopper : HGX H200 et H100 SXM à grande échelle, disponibles dès aujourd'hui dans toutes les régions
  • Ampere et Ada : A100 80GB, L40S et RTX PRO 6000 Blackwell pour l'inférence et la visualisation
GB300 NVL72 — baie de 72 GPU~132 kW
Nœud HGX B300 de 8 GPU~14.3 kW
Nœud HGX B200 de 8 GPU~10.2 kW
Nœud HGX H200 de 8 GPU~10.2 kW
Nœud HGX H100 de 8 GPU~10.2 kW
Nœud HGX A100 de 8 GPU~6.5 kW
L40S / RTX PRO 6000 — 8× PCIe~4.2 kW
Quantum-X800 XDR leaf / spine800G
Ethernet Spectrum-X SN5600800G

Enveloppes de puissance indicatives par baie et par nœud utilisées pour la planification de capacité. La consommation réelle dépend du châssis OEM, du mode de refroidissement et du profil de charge.

Tarifs indicatifs

Des tarifs GPU transparents, publiés d'avance

Tarifs de départ pour de la capacité mono-locataire. Les clusters réservés multinœuds et les contrats de 12 à 36 mois font l'objet de devis individuels : les engagements importants passent nettement sous ces chiffres.

AccélérateurMémoireÀ la demandeRéservation 6 moisNœud 8 GPU / moisStatut
GB300 NVL72288 GB HBM3eà partir de $8.91$8.20Échelle rack — sur devisT4 2026
B300 SXM288 GB HBM3eà partir de $8.34$7.67à partir de $44,800Limité
B200 SXM180 GB HBM3eà partir de $6.61$6.08à partir de $38,000Disponible
H200 SXM141 GB HBM3eà partir de $3.79$3.49à partir de $23,900Disponible
H100 SXM80 GB HBM3à partir de $3.10$2.85à partir de $18,400Disponible
A100 SXM 80GB80 GB HBM2eà partir de $1.90$1.75à partir de $10,400Disponible

Tarifs de liste indicatifs en USD, hors taxes, en vigueur en septembre 2026. Les prix varient selon la région, la durée, le stockage et le profil de trafic sortant, et sont confirmés dans un devis écrit. Voir la grille tarifaire complète.

Déploiement de LLM privés

Exécutez des modèles à poids ouverts de frontière dans votre propre périmètre

Velyrix déploie, quantifie et optimise les principales familles de modèles à poids ouverts sur du matériel Velyrix dédié, dans votre propre espace de colocation ou totalement isolé sur site, avec une API compatible OpenAI et des critères de recette mesurés en tokens par seconde.

DeepSeekQwen LlamaOpenAI gpt-oss MistralGLM KimiMiniMax GemmaNVIDIA Nemotron
velyrix-inference-endpoint.sh
# Your private endpoint — no data leaves your VPC
curl https://llm.internal.acme.com/v1/chat/completions \
  -H "Authorization: Bearer $VELYRIX_KEY" \
  -d '{
    "model": "deepseek-v3-fp8",
    "messages": [{"role":"user","content":"Summarise Q3 risk report"}],
    "max_tokens": 1024
  }'

# Served by vLLM on 8x NVIDIA H200 — measured at handover
throughput  : 14,850 tok/s aggregate
ttft_p95    : 218 ms
availability: 99.9% monthly SLA
Où nous déployons

25 marchés dans 18 pays — tous conformes à l'export

Velyrix n'installe de la capacité que dans des juridictions où les accélérateurs NVIDIA avancés peuvent être déployés légalement et sans risque de licence, dans des centres de données partenaires neutres et audités de façon indépendante. Deux marchés sont en service avec de la capacité réservée aujourd'hui ; les autres sont livrés sur demande selon votre besoin précis. Nous vous disons lequel est lequel avant tout engagement — voir le tableau de statut complet.

Ashburn, VirginieEn service — capacité réservée
États-Unis · jusqu'à 160 kW
US-EAST-1 · H100 / H200 / B200 / GB300
Dallas, TexasEn service — capacité réservée
États-Unis · jusqu'à 160 kW
US-CENTRAL-1 · H200 / B200 / B300
Chicago, IllinoisSur demande
États-Unis · jusqu'à 80 kW
US-CENTRAL-2 · H100 / H200
Phoenix, ArizonaSur demande
États-Unis · jusqu'à 80 kW
US-WEST-2 · H100 / A100 / L40S
Santa Clara, CalifornieSur demande
États-Unis · jusqu'à 60 kW
US-WEST-1 · H100 / H200
Montréal, QuébecSur demande
Canada · jusqu'à 120 kW
CA-EAST-1 · H100 / H200 / B200
Toronto, OntarioSur demande
Canada · jusqu'à 60 kW
CA-EAST-2 · H100 / L40S
QuerétaroSur demande
Mexique · jusqu'à 80 kW
MX-CENTRAL-1 · H100 / H200
MonterreyPrévu 2027
Mexique · jusqu'à 120 kW
MX-NORTH-1 · H200 / B200
LondresSur demande
Royaume-Uni · jusqu'à 80 kW
EU-WEST-2 · H100 / H200
DublinSur demande
Irlande · jusqu'à 60 kW
EU-WEST-1 · H100 / L40S
ParisSur demande
France · jusqu'à 100 kW
EU-WEST-3 · H200 / B200
FrancfortSur demande
Allemagne · jusqu'à 120 kW
EU-CENTRAL-1 · H200 / B200
AmsterdamSur demande
Pays-Bas · jusqu'à 60 kW
EU-WEST-4 · H100 / L40S
MadridSur demande
Espagne · jusqu'à 80 kW
EU-SOUTH-1 · H100 / H200
MilanPrévu 2027
Italie · jusqu'à 80 kW
EU-SOUTH-2 · H200 / B200
StockholmPrévu 2027
Suède · jusqu'à 160 kW
EU-NORTH-1 · B200 / B300
HelsinkiPrévu 2027
Finlande · jusqu'à 160 kW
EU-NORTH-3 · B200 / B300
VarsoviePrévu 2027
Pologne · jusqu'à 80 kW
EU-CENTRAL-2 · H100 / H200
TokyoSur demande
Japon · jusqu'à 80 kW
AP-NORTHEAST-1 · H100 / H200
OsakaPrévu 2027
Japon · jusqu'à 120 kW
AP-NORTHEAST-3 · H200 / B200
SéoulSur demande
Corée du Sud · jusqu'à 100 kW
AP-NORTHEAST-2 · H100 / H200
TaipeiSur demande
Taïwan · jusqu'à 100 kW
AP-EAST-2 · H100 / H200 / B200
SydneySur demande
Australie · jusqu'à 80 kW
AP-SOUTHEAST-2 · H100 / H200
AucklandPrévu 2027
Nouvelle-Zélande · jusqu'à 60 kW
AP-SOUTHEAST-5 · H100 / L40S

« En service » signifie que Velyrix dispose aujourd'hui d'espace et d'énergie sous contrat. « Sur demande » signifie que nous contractons l'espace en fonction de votre besoin précis, ce qui ajoute environ deux à six semaines. « Prévu » signifie que la négociation est en cours et que nous ne prendrons pas de commande sur cette base. Chaque marché de cette liste est une destination autorisée pour les accélérateurs que nous déployons, et chaque commande fait l'objet d'une vérification avant expédition ; voir conformité commerciale et comment nous choisissons les pays.

Neutralité vis-à-vis des fabricants

Quoi que vous achetiez, nous savons le déployer

Velyrix dispose de manuels de déploiement validés — élévation de baie, plan de puissance, mode de refroidissement, plan de câblage et profil de recette — pour les plateformes que le marché livre réellement.

Dell TechnologiesPowerEdge XE9680 · XE9712
SupermicroSYS-821GE · GB300 NVL72
GIGABYTEG593 · G894 · XL44
HPECray XD670 · XD685
LenovoSR675 V3 · SR685a V3

Également les conceptions NVIDIA DGX, ASUS, QCT, Wiwynn et Foxconn ORv3. Les noms de plateforme sont des marques de leurs propriétaires respectifs, citées pour décrire notre capacité de déploiement. Vous êtes OEM, distributeur ou revendeur ? Voir notre programme partenaires.

Pourquoi les opérateurs choisissent Velyrix

L'ingénierie d'un hyperscaler, la réactivité d'un spécialiste

Des semaines, pas des trimestres

Clusters réservés livrés en 4 à 8 semaines ; capacité à la demande active en quelques minutes. Usines IA neuves mises en service en 12 à 20 semaines.

📊

Le débit utile, pas seulement les FLOPS

Nous contractons sur le débit utile mesuré du cluster. Chaque livraison inclut les chiffres de recette de bande passante NCCL et de MFU soutenue — et si nous manquons le chiffre convenu, nous le corrigeons à nos frais.

🔒

Mono-locataire par défaut

Hôtes dédiés, partitions de fabric dédiées, clés de chiffrement détenues par le client et enclaves isolées en option.

Efficace par conception

PUE de conception de 1,15 à 1,25 avec refroidissement liquide direct au chip, récupération de chaleur lorsque c'est possible et contractualisation d'énergie renouvelable.

Nous préférons remplir cet espace d'engagements plutôt que de logos. Voici donc ce qui figure dans votre contrat : des critères de recette mesurés et testés avant paiement, des avoirs de service appliqués automatiquement sans procédure de réclamation, des conditions au mois disponibles sur l'hébergement BYOG, et le numéro direct de l'ingénieur qui a construit votre cluster.

Questions fréquentes

Puis-je apporter des serveurs GPU que j'ai achetés moi-même ?

Oui, c'est notre modèle phare Apportez vos GPU. Achetez des serveurs NVIDIA GPU auprès de n'importe quel OEM ou distributeur agréé, expédiez-les directement vers un site Velyrix, et notre équipe d'ingénierie prend en charge le déploiement, le réseau, le refroidissement, la configuration du cluster, la supervision et le support continu. Vous conservez la propriété, la garantie et la relation avec l'OEM ; l'assistance à l'achat est optionnelle et jamais obligatoire.

Qu'est-ce qu'un neocloud, et en quoi Velyrix diffère-t-il d'un hyperscaler ?

Un neocloud est un fournisseur cloud conçu spécifiquement pour le calcul accéléré plutôt que pour l'informatique généraliste. Velyrix n'exploite que de l'infrastructure IA : salles haute densité refroidies à l'eau, parcs de GPU NVIDIA, fabrics InfiniBand et Spectrum-X sans perte et stockage parallèle. Cette spécialisation se traduit par une densité de GPU par baie plus élevée, des fabrics non bloquants en standard, des tarifs publiés et un accès direct aux ingénieurs qui ont construit votre cluster.

Quels GPU NVIDIA puis-je louer ou héberger chez Velyrix ?

Velyrix prend en charge les systèmes NVIDIA GB300 NVL72, HGX B300, HGX B200, HGX H200, HGX H100, HGX A100, L40S et RTX PRO 6000 Blackwell des principaux OEM, disponibles en instances de cloud GPU, en serveurs dédiés bare metal ou en matériel appartenant au client hébergé en colocation Velyrix.

Puis-je apporter mes propres serveurs GPU plutôt que de louer ?

Oui. La colocation Velyrix est conçue pour des baies de 40 à 160 kW avec air, échangeur de porte arrière et refroidissement liquide direct au chip, et accepte les systèmes HGX, DGX, MGX et OCP ORv3 de Dell, Supermicro, HPE, Lenovo, Gigabyte, QCT et d'autres. Nous pouvons aussi déployer et mettre en service le matériel pour vous.

Dans quel délai un cluster peut-il être livré ?

Les instances de cloud GPU à la demande démarrent en moins de 90 secondes. Les clusters réservés multinœuds dans une salle existante sont généralement actifs en 4 à 8 semaines. La construction d'une usine IA neuve, fabric, refroidissement et mise en service compris, prend normalement de 12 à 20 semaines selon les délais du matériel.

Aidez-vous à déployer notre propre LLM plutôt que d'utiliser une API publique ?

Oui. Notre service de Déploiement et d'Optimisation de LLM Privés installe, quantifie, mesure et exploite des modèles à poids ouverts tels que DeepSeek, Qwen, Llama, OpenAI gpt-oss, Mistral, GLM, Kimi, MiniMax, Gemma et NVIDIA Nemotron sur une infrastructure que vous contrôlez, exposés via une API compatible OpenAI avec des objectifs contractuels de débit et de latence.