Apportez vos propres GPU. Nous construisons l'usine IA autour d'eux.
Achetez vos serveurs NVIDIA GPU auprès de n'importe quel OEM ou distributeur agréé, expédiez-les directement vers un site Velyrix, et notre équipe d'ingénierie prend en charge le déploiement, le réseau, le refroidissement, la configuration du cluster, la supervision et le support continu. Vous préférez ne pas posséder le matériel ? Louez la même classe de cluster dans notre parc. Dans les deux cas, un seul interlocuteur du quai de déchargement au modèle en production.
Apportez vos GPU : vous achetez le matériel, nous l'exploitons aussi longtemps qu'il vous appartient
Achetez vos serveurs NVIDIA GPU auprès de n'importe quel OEM ou distributeur agréé — Dell, Supermicro, GIGABYTE, HPE, Lenovo ou un autre. Expédiez-les directement vers notre site, et notre équipe d'ingénierie prendra en charge le déploiement, le réseau, le refroidissement, la configuration du cluster, la supervision et le support continu. Nous ne gagnons pas d'argent sur vos serveurs. Nous gagnons de l'argent en les maintenant en marche.
Une assistance à l'achat est disponible — revue de configuration, comparatif de plateformes neutre et informations réelles sur les délais — mais vous n'êtes jamais obligé d'acheter du matériel via Velyrix, et votre tarif est identique dans les deux cas.
Neuf façons de travailler avec Velyrix
Apportez votre matériel dans nos salles, louez à l'heure, réservez un cluster privé, confiez-nous la construction et la recette de toute l'usine IA — ou revendez l'ensemble sous votre propre marque.
Apportez vos GPU
Vous achetez les serveurs NVIDIA chez n'importe quel OEM et conservez l'actif. Nous les déployons, les refroidissons, les connectons, les supervisons et les supportons — sans marge sur le matériel et sans verrouillage.
- N'importe quel OEM ou distributeur agréé
- Installation préservant la garantie
- Assistance à l'achat en option
Cloud GPU
Instances NVIDIA GPU à la demande et réservées, avec entraînement multinœud connecté en InfiniBand, Slurm ou Kubernetes, et facturation à la seconde.
- H100, H200, B200, B300 et GB300
- Clusters de 8 à 4 096 GPU
- Démarrage en moins de 90 secondes
Serveurs GPU dédiés
Bare metal mono-locataire au mois ou à l'année. Accès root, pas de surcoût d'hyperviseur, pas de voisins bruyants, tarifs publiés en toute transparence.
- Nœuds 8×H100 / H200 / B200
- A100, L40S, RTX PRO 6000
- Contrats de 1 à 36 mois
Colocation IA
Apportez vos systèmes HGX, DGX, MGX ou GPU OEM dans des salles refroidies à l'eau conçues pour des baies de 40 à 160 kW.
- Air, RDHx et liquide direct au chip
- Cage, salle privée ou wholesale
- Interventions sur site 24×7
Déploiement et mise en service d'infrastructure IA
Construction clés en main : étude de site, montage en baie, câblage du fabric, firmware, burn-in, validation NCCL et recette documentée.
- Livraison d'usines IA neuves
- Construction de fabric InfiniBand et Spectrum-X
- Rapports de recette signés
Déploiement et optimisation de LLM privés
Votre propre endpoint DeepSeek, Qwen, Llama, GPT-OSS, Mistral, GLM, Kimi, MiniMax, Gemma ou Nemotron — réglé, quantifié et compatible environnement isolé.
- Service via vLLM, SGLang et TensorRT-LLM
- Quantification FP8 / FP4 / AWQ
- Fine-tuning LoRA et RAG
Stockage, réseau et exploitation infogérée
Systèmes de fichiers parallèles, stockage objet, transit 400G, interconnexion privée et un NOC 24×7 qui exploite le cluster pour vous.
- Niveaux WEKA / VAST / Ceph
- Slurm et Kubernetes infogérés
- Observabilité et rapports SLA
Migration, audit et cycle de vie
Déplacez un parc GPU en production entre salles ou fournisseurs, ou faites-vous expliquer par une équipe d'ingénierie indépendante pourquoi votre cluster actuel sous-performe.
- Migration par phases avec interruption minimale
- Audit fabric, firmware et MFU
- Renouvellement et mise hors service certifiée
Partenaires OEM et canal
Nous sommes l'équipe de déploiement et de support derrière le matériel que vous vendez — sous votre marque, avec enregistrement d'affaire et une politique écrite de neutralité de canal.
- Déploiement en marque blanche et recette
- Support L1–L3, RMA et pièces
- Nous ne revendons jamais de serveurs nous-mêmes
Toutes les générations d'accélérateurs NVIDIA, chez un seul opérateur
D'Ampere pour l'inférence optimisée en coût aux baies Blackwell Ultra pour l'entraînement à mille milliards de paramètres, Velyrix applique un modèle d'exploitation unique à tout le parc : la même conception de fabric, la même supervision, le même SLA.
- Blackwell Ultra : NVIDIA GB300 NVL72 et HGX B300 dans des salles refroidies par liquide direct au chip
- Blackwell : Nœuds HGX B200 de 8 GPU avec 1,4 To de HBM3e par nœud
- Hopper : HGX H200 et H100 SXM à grande échelle, disponibles dès aujourd'hui dans toutes les régions
- Ampere et Ada : A100 80GB, L40S et RTX PRO 6000 Blackwell pour l'inférence et la visualisation
Enveloppes de puissance indicatives par baie et par nœud utilisées pour la planification de capacité. La consommation réelle dépend du châssis OEM, du mode de refroidissement et du profil de charge.
Des tarifs GPU transparents, publiés d'avance
Tarifs de départ pour de la capacité mono-locataire. Les clusters réservés multinœuds et les contrats de 12 à 36 mois font l'objet de devis individuels : les engagements importants passent nettement sous ces chiffres.
| Accélérateur | Mémoire | À la demande | Réservation 6 mois | Nœud 8 GPU / mois | Statut |
|---|---|---|---|---|---|
| GB300 NVL72 | 288 GB HBM3e | à partir de $8.91 | $8.20 | Échelle rack — sur devis | T4 2026 |
| B300 SXM | 288 GB HBM3e | à partir de $8.34 | $7.67 | à partir de $44,800 | Limité |
| B200 SXM | 180 GB HBM3e | à partir de $6.61 | $6.08 | à partir de $38,000 | Disponible |
| H200 SXM | 141 GB HBM3e | à partir de $3.79 | $3.49 | à partir de $23,900 | Disponible |
| H100 SXM | 80 GB HBM3 | à partir de $3.10 | $2.85 | à partir de $18,400 | Disponible |
| A100 SXM 80GB | 80 GB HBM2e | à partir de $1.90 | $1.75 | à partir de $10,400 | Disponible |
Tarifs de liste indicatifs en USD, hors taxes, en vigueur en septembre 2026. Les prix varient selon la région, la durée, le stockage et le profil de trafic sortant, et sont confirmés dans un devis écrit. Voir la grille tarifaire complète.
Exécutez des modèles à poids ouverts de frontière dans votre propre périmètre
Velyrix déploie, quantifie et optimise les principales familles de modèles à poids ouverts sur du matériel Velyrix dédié, dans votre propre espace de colocation ou totalement isolé sur site, avec une API compatible OpenAI et des critères de recette mesurés en tokens par seconde.
# Your private endpoint — no data leaves your VPC curl https://llm.internal.acme.com/v1/chat/completions \ -H "Authorization: Bearer $VELYRIX_KEY" \ -d '{ "model": "deepseek-v3-fp8", "messages": [{"role":"user","content":"Summarise Q3 risk report"}], "max_tokens": 1024 }' # Served by vLLM on 8x NVIDIA H200 — measured at handover throughput : 14,850 tok/s aggregate ttft_p95 : 218 ms availability: 99.9% monthly SLA
25 marchés dans 18 pays — tous conformes à l'export
Velyrix n'installe de la capacité que dans des juridictions où les accélérateurs NVIDIA avancés peuvent être déployés légalement et sans risque de licence, dans des centres de données partenaires neutres et audités de façon indépendante. Deux marchés sont en service avec de la capacité réservée aujourd'hui ; les autres sont livrés sur demande selon votre besoin précis. Nous vous disons lequel est lequel avant tout engagement — voir le tableau de statut complet.
« En service » signifie que Velyrix dispose aujourd'hui d'espace et d'énergie sous contrat. « Sur demande » signifie que nous contractons l'espace en fonction de votre besoin précis, ce qui ajoute environ deux à six semaines. « Prévu » signifie que la négociation est en cours et que nous ne prendrons pas de commande sur cette base. Chaque marché de cette liste est une destination autorisée pour les accélérateurs que nous déployons, et chaque commande fait l'objet d'une vérification avant expédition ; voir conformité commerciale et comment nous choisissons les pays.
Quoi que vous achetiez, nous savons le déployer
Velyrix dispose de manuels de déploiement validés — élévation de baie, plan de puissance, mode de refroidissement, plan de câblage et profil de recette — pour les plateformes que le marché livre réellement.
Également les conceptions NVIDIA DGX, ASUS, QCT, Wiwynn et Foxconn ORv3. Les noms de plateforme sont des marques de leurs propriétaires respectifs, citées pour décrire notre capacité de déploiement. Vous êtes OEM, distributeur ou revendeur ? Voir notre programme partenaires.
L'ingénierie d'un hyperscaler, la réactivité d'un spécialiste
Des semaines, pas des trimestres
Clusters réservés livrés en 4 à 8 semaines ; capacité à la demande active en quelques minutes. Usines IA neuves mises en service en 12 à 20 semaines.
Le débit utile, pas seulement les FLOPS
Nous contractons sur le débit utile mesuré du cluster. Chaque livraison inclut les chiffres de recette de bande passante NCCL et de MFU soutenue — et si nous manquons le chiffre convenu, nous le corrigeons à nos frais.
Mono-locataire par défaut
Hôtes dédiés, partitions de fabric dédiées, clés de chiffrement détenues par le client et enclaves isolées en option.
Efficace par conception
PUE de conception de 1,15 à 1,25 avec refroidissement liquide direct au chip, récupération de chaleur lorsque c'est possible et contractualisation d'énergie renouvelable.
Nous préférons remplir cet espace d'engagements plutôt que de logos. Voici donc ce qui figure dans votre contrat : des critères de recette mesurés et testés avant paiement, des avoirs de service appliqués automatiquement sans procédure de réclamation, des conditions au mois disponibles sur l'hébergement BYOG, et le numéro direct de l'ingénieur qui a construit votre cluster.
Questions fréquentes
Puis-je apporter des serveurs GPU que j'ai achetés moi-même ?
Oui, c'est notre modèle phare Apportez vos GPU. Achetez des serveurs NVIDIA GPU auprès de n'importe quel OEM ou distributeur agréé, expédiez-les directement vers un site Velyrix, et notre équipe d'ingénierie prend en charge le déploiement, le réseau, le refroidissement, la configuration du cluster, la supervision et le support continu. Vous conservez la propriété, la garantie et la relation avec l'OEM ; l'assistance à l'achat est optionnelle et jamais obligatoire.
Qu'est-ce qu'un neocloud, et en quoi Velyrix diffère-t-il d'un hyperscaler ?
Un neocloud est un fournisseur cloud conçu spécifiquement pour le calcul accéléré plutôt que pour l'informatique généraliste. Velyrix n'exploite que de l'infrastructure IA : salles haute densité refroidies à l'eau, parcs de GPU NVIDIA, fabrics InfiniBand et Spectrum-X sans perte et stockage parallèle. Cette spécialisation se traduit par une densité de GPU par baie plus élevée, des fabrics non bloquants en standard, des tarifs publiés et un accès direct aux ingénieurs qui ont construit votre cluster.
Quels GPU NVIDIA puis-je louer ou héberger chez Velyrix ?
Velyrix prend en charge les systèmes NVIDIA GB300 NVL72, HGX B300, HGX B200, HGX H200, HGX H100, HGX A100, L40S et RTX PRO 6000 Blackwell des principaux OEM, disponibles en instances de cloud GPU, en serveurs dédiés bare metal ou en matériel appartenant au client hébergé en colocation Velyrix.
Puis-je apporter mes propres serveurs GPU plutôt que de louer ?
Oui. La colocation Velyrix est conçue pour des baies de 40 à 160 kW avec air, échangeur de porte arrière et refroidissement liquide direct au chip, et accepte les systèmes HGX, DGX, MGX et OCP ORv3 de Dell, Supermicro, HPE, Lenovo, Gigabyte, QCT et d'autres. Nous pouvons aussi déployer et mettre en service le matériel pour vous.
Dans quel délai un cluster peut-il être livré ?
Les instances de cloud GPU à la demande démarrent en moins de 90 secondes. Les clusters réservés multinœuds dans une salle existante sont généralement actifs en 4 à 8 semaines. La construction d'une usine IA neuve, fabric, refroidissement et mise en service compris, prend normalement de 12 à 20 semaines selon les délais du matériel.
Aidez-vous à déployer notre propre LLM plutôt que d'utiliser une API publique ?
Oui. Notre service de Déploiement et d'Optimisation de LLM Privés installe, quantifie, mesure et exploite des modèles à poids ouverts tels que DeepSeek, Qwen, Llama, OpenAI gpt-oss, Mistral, GLM, Kimi, MiniMax, Gemma et NVIDIA Nemotron sur une infrastructure que vous contrôlez, exposés via une API compatible OpenAI avec des objectifs contractuels de débit et de latence.