Trae tus propias GPU. Construimos la fábrica de IA a su alrededor.
Compra tus servidores NVIDIA GPU a cualquier OEM o distribuidor autorizado, envíalos directamente a una instalación de Velyrix y nuestro equipo de ingeniería se encarga del despliegue, la red, la refrigeración, la configuración del clúster, la monitorización y el soporte continuo. ¿Prefieres no poseer el hardware? Alquila la misma clase de clúster de nuestra flota. En cualquier caso, un solo interlocutor desde el muelle de carga hasta el modelo en producción.
Trae tu propia GPU: tú compras el hardware, nosotros lo operamos mientras sea tuyo
Compra tus servidores NVIDIA GPU a cualquier OEM o distribuidor autorizado — Dell, Supermicro, GIGABYTE, HPE, Lenovo o cualquier otro. Envíalos directamente a nuestra instalación y nuestro equipo de ingeniería se encargará del despliegue, la red, la refrigeración, la configuración del clúster, la monitorización y el soporte continuo. No ganamos dinero con tus servidores. Ganamos dinero manteniéndolos en marcha.
La asistencia de compra es opcional — revisión de configuración, comparativa de plataformas neutral y datos reales de plazos de entrega — pero nunca es obligatorio comprar hardware a través de Velyrix, y tu precio es idéntico en ambos casos.
Nueve formas de trabajar con Velyrix
Trae tu propio hardware a nuestras salas, alquila por horas, arrienda un clúster privado, deja que construyamos y pongamos en servicio toda la fábrica de IA — o vende todo ello bajo tu propia marca.
Trae tu propia GPU
Tú compras los servidores NVIDIA a cualquier OEM y conservas el activo. Nosotros los desplegamos, refrigeramos, conectamos, monitorizamos y soportamos, sin margen sobre el hardware y sin ataduras.
- Cualquier OEM o distribuidor autorizado
- Instalación que preserva la garantía
- Asistencia de compra opcional
Nube GPU
Instancias NVIDIA GPU bajo demanda y reservadas, con entrenamiento multinodo conectado por InfiniBand, Slurm o Kubernetes, y facturación por segundo.
- H100, H200, B200, B300 y GB300
- Clústeres de 8 a 4.096 GPU
- Arranque en menos de 90 segundos
Servidores GPU dedicados
Bare metal de un solo inquilino por mes o año. Acceso root, sin sobrecarga de hipervisor, sin vecinos ruidosos y precios publicados con transparencia.
- Nodos 8×H100 / H200 / B200
- A100, L40S, RTX PRO 6000
- Contratos de 1 a 36 meses
Colocation de IA
Trae tus sistemas HGX, DGX, MGX o GPU de OEM a salas refrigeradas por líquido diseñadas para racks de 40–160 kW.
- Aire, RDHx y líquido directo al chip
- Jaula, sala privada o mayorista
- Manos remotas 24×7
Despliegue y puesta en servicio de infraestructura de IA
Construcción llave en mano: inspección del sitio, montaje en rack, cableado de fabric, firmware, burn-in, validación NCCL y pruebas de aceptación documentadas.
- Entrega de fábricas de IA nuevas
- Construcción de fabric InfiniBand y Spectrum-X
- Informes de aceptación firmados
Despliegue y optimización de LLM privados
Tu propio endpoint DeepSeek, Qwen, Llama, GPT-OSS, Mistral, GLM, Kimi, MiniMax, Gemma o Nemotron, ajustado, cuantizado y apto para entornos aislados.
- Servicio con vLLM, SGLang y TensorRT-LLM
- Cuantización FP8 / FP4 / AWQ
- Fine-tuning LoRA y RAG
Almacenamiento, red y operación gestionada
Sistemas de ficheros paralelos, almacenamiento de objetos, tránsito de 400G, interconexión privada y un NOC 24×7 que opera el clúster por ti.
- Niveles WEKA / VAST / Ceph
- Slurm y Kubernetes gestionados
- Observabilidad e informes de SLA
Migración, auditoría y ciclo de vida
Traslada una flota GPU en producción entre salas o proveedores, o deja que un equipo de ingeniería independiente te explique por qué tu clúster actual rinde por debajo de lo esperado.
- Migración por fases con mínima interrupción
- Auditoría de fabric, firmware y MFU
- Renovación y baja certificada
Partners OEM y de canal
Somos el equipo de despliegue y soporte detrás del hardware que vendes, bajo tu marca, con registro de oportunidades y una política escrita de neutralidad de canal.
- Despliegue de marca blanca y ATP
- Soporte L1–L3, RMA y repuestos
- Nunca revendemos servidores nosotros mismos
Todas las generaciones de aceleradores NVIDIA, con un solo operador
Desde Ampere para inferencia optimizada en coste hasta racks Blackwell Ultra para entrenamiento de billones de parámetros, Velyrix aplica un único modelo operativo a toda la flota: el mismo diseño de fabric, la misma monitorización, el mismo SLA.
- Blackwell Ultra: NVIDIA GB300 NVL72 y HGX B300 en salas refrigeradas por líquido directo al chip
- Blackwell: Nodos HGX B200 de 8 GPU con 1,4 TB de HBM3e por nodo
- Hopper: HGX H200 y H100 SXM a escala, disponibles hoy en todas las regiones
- Ampere y Ada: A100 80GB, L40S y RTX PRO 6000 Blackwell para inferencia y visualización
Envolventes de potencia indicativas por rack y nodo utilizadas para la planificación de capacidad. El consumo real depende del chasis del OEM, el método de refrigeración y el perfil de la carga.
Precios de GPU transparentes, publicados por adelantado
Tarifas de partida para capacidad de un solo inquilino. Los clústeres reservados multinodo y los contratos de 12 a 36 meses se presupuestan individualmente: los compromisos mayores quedan muy por debajo de estas cifras.
| Acelerador | Memoria | Bajo demanda | Reserva 6 meses | Nodo de 8 GPU / mes | Estado |
|---|---|---|---|---|---|
| GB300 NVL72 | 288 GB HBM3e | desde $8.91 | $8.20 | Escala rack — a consultar | T4 2026 |
| B300 SXM | 288 GB HBM3e | desde $8.34 | $7.67 | desde $44,800 | Limitado |
| B200 SXM | 180 GB HBM3e | desde $6.61 | $6.08 | desde $38,000 | Disponible |
| H200 SXM | 141 GB HBM3e | desde $3.79 | $3.49 | desde $23,900 | Disponible |
| H100 SXM | 80 GB HBM3 | desde $3.10 | $2.85 | desde $18,400 | Disponible |
| A100 SXM 80GB | 80 GB HBM2e | desde $1.90 | $1.75 | desde $10,400 | Disponible |
Precios de lista indicativos en USD, sin impuestos, vigentes en septiembre de 2026. Los precios varían según región, plazo, almacenamiento y perfil de tráfico, y se confirman en un presupuesto por escrito. Consulta la lista de precios completa.
Ejecuta modelos de pesos abiertos de frontera dentro de tu propio perímetro
Velyrix despliega, cuantiza y optimiza las principales familias de modelos de pesos abiertos en hardware dedicado de Velyrix, en tu propio espacio de colocation o totalmente aislado on-premise, con una API compatible con OpenAI y criterios de aceptación medidos en tokens por segundo.
# Your private endpoint — no data leaves your VPC curl https://llm.internal.acme.com/v1/chat/completions \ -H "Authorization: Bearer $VELYRIX_KEY" \ -d '{ "model": "deepseek-v3-fp8", "messages": [{"role":"user","content":"Summarise Q3 risk report"}], "max_tokens": 1024 }' # Served by vLLM on 8x NVIDIA H200 — measured at handover throughput : 14,850 tok/s aggregate ttft_p95 : 218 ms availability: 99.9% monthly SLA
25 mercados en 18 países, todos ellos limpios en materia de exportación
Velyrix solo instala capacidad en jurisdicciones donde los aceleradores NVIDIA avanzados pueden desplegarse legalmente y sin riesgo de licencias, dentro de centros de datos asociados neutrales e auditados de forma independiente. Dos mercados están activos con capacidad reservada hoy; el resto se entrega bajo petición según tu necesidad concreta. Te decimos cuál es cuál antes de que te comprometas: consulta la tabla de estado completa.
"Activo" significa que Velyrix tiene hoy espacio y energía contratados. "Bajo petición" significa que contratamos espacio según tu requisito concreto, añadiendo entre dos y seis semanas. "Previsto" significa que sigue en negociación y no aceptaremos un pedido contra ello. Todos los mercados de esta lista son destinos permitidos para los aceleradores que desplegamos y cada pedido se verifica antes del envío; consulta cumplimiento comercial y cómo elegimos los países.
Compres lo que compres, sabemos desplegarlo
Velyrix mantiene manuales de despliegue validados — alzado de rack, esquema de potencia, método de refrigeración, plan de cableado y perfil de aceptación — para las plataformas que el mercado realmente entrega.
También diseños NVIDIA DGX, ASUS, QCT, Wiwynn y Foxconn ORv3. Los nombres de plataforma son marcas de sus respectivos propietarios y se citan para describir nuestra capacidad de despliegue. ¿Eres OEM, distribuidor o revendedor? Consulta nuestro programa de partners.
Ingeniería de hiperescala, capacidad de respuesta de especialista
Semanas, no trimestres
Clústeres reservados entregados en 4–8 semanas; capacidad bajo demanda activa en minutos. Fábricas de IA nuevas puestas en servicio en 12–20 semanas.
Rendimiento útil, no solo FLOPS
Contratamos sobre rendimiento útil medido del clúster. Cada entrega incluye cifras de aceptación de ancho de banda NCCL y MFU sostenida — y si no alcanzamos la cifra acordada, lo corregimos a nuestra costa.
Un solo inquilino por defecto
Hosts dedicados, particiones de fabric dedicadas, claves de cifrado en poder del cliente y enclaves aislados opcionales.
Eficiente por diseño
PUE de diseño de 1,15–1,25 con refrigeración líquida directa al chip, reutilización de calor donde es posible y contratación de energía renovable.
Preferimos llenar este espacio con compromisos antes que con logotipos. Esto es lo que entra en tu contrato: criterios de aceptación medidos y probados antes de pagar, créditos de servicio que se aplican automáticamente sin reclamación, condiciones mes a mes disponibles en el alojamiento BYOG y el teléfono directo del ingeniero que construyó tu clúster.
Preguntas frecuentes
¿Puedo traer servidores GPU que he comprado yo?
Sí, ese es nuestro modelo principal, Trae tu propia GPU. Compra servidores NVIDIA GPU a cualquier OEM o distribuidor autorizado, envíalos directamente a una instalación de Velyrix y nuestro equipo de ingeniería se encarga del despliegue, la red, la refrigeración, la configuración del clúster, la monitorización y el soporte continuo. Tú conservas la propiedad, la garantía y la relación con el OEM; la asistencia de compra es opcional y nunca obligatoria.
¿Qué es un neocloud y en qué se diferencia Velyrix de un hiperescalador?
Un neocloud es un proveedor de nube creado específicamente para computación acelerada en lugar de TI de propósito general. Velyrix opera únicamente infraestructura de IA: salas de alta densidad refrigeradas por líquido, flotas de GPU NVIDIA, fabrics InfiniBand y Spectrum-X sin pérdidas y almacenamiento paralelo. Ese enfoque se traduce en mayor densidad de GPU por rack, fabrics sin bloqueo de serie, precios publicados y acceso directo a los ingenieros que construyeron tu clúster.
¿Qué GPU NVIDIA puedo alquilar o alojar con Velyrix?
Velyrix admite sistemas NVIDIA GB300 NVL72, HGX B300, HGX B200, HGX H200, HGX H100, HGX A100, L40S y RTX PRO 6000 Blackwell de los principales OEM, disponibles como instancias de nube GPU, servidores dedicados bare metal o hardware propiedad del cliente alojado en colocation de Velyrix.
¿Puedo traer mis propios servidores GPU en lugar de alquilar?
Sí. La colocation de Velyrix está diseñada para racks de 40-160 kW con aire, intercambiador de puerta trasera y refrigeración líquida directa al chip, y admite sistemas HGX, DGX, MGX y OCP ORv3 de Dell, Supermicro, HPE, Lenovo, Gigabyte, QCT y otros. También podemos desplegar y poner en servicio el hardware por ti.
¿Con qué rapidez se puede entregar un clúster?
Las instancias de nube GPU bajo demanda arrancan en menos de 90 segundos. Los clústeres reservados multinodo en una sala existente suelen estar activos en 4-8 semanas. La construcción de una fábrica de IA nueva, incluidos fabric, refrigeración y puesta en servicio, lleva normalmente de 12 a 20 semanas según los plazos del hardware.
¿Ayudáis a desplegar nuestro propio LLM en lugar de usar una API pública?
Sí. Nuestro servicio de Despliegue y Optimización de LLM Privados instala, cuantiza, mide y opera modelos de pesos abiertos como DeepSeek, Qwen, Llama, OpenAI gpt-oss, Mistral, GLM, Kimi, MiniMax, Gemma y NVIDIA Nemotron sobre infraestructura que tú controlas, expuestos mediante una API compatible con OpenAI y con objetivos de rendimiento y latencia contratados.