Traga sua própria GPU  compre de qualquer OEM · envie para nós · nós operamos

Traga suas próprias GPUs. Construímos a fábrica de IA em volta delas.

Compre seus servidores NVIDIA GPU de qualquer OEM ou distribuidor autorizado, envie-os diretamente para uma instalação da Velyrix e nossa equipe de engenharia cuida da implantação, rede, refrigeração, configuração do cluster, monitoramento e suporte contínuo. Prefere não ser dono do hardware? Alugue a mesma classe de cluster da nossa frota. De qualquer forma, um único parceiro da doca de carga ao modelo em produção.

0%Margem sobre o hardware que você mesmo compra
72 hBurn-in e aceitação assinada antes da entrega
15 minResposta P1 contratual, 24×7
3.2 Tb/sInfiniBand XDR sem bloqueio por nó
NVIDIA HGX B300GB300 NVL72HGX B200HGX H200HGX H100 Quantum-X800 InfiniBandEthernet Spectrum-XBlueField-3 DPU Refrigeração líquida direta ao chipSlurm e KubernetesvLLM / SGLang / TensorRT-LLM Armazenamento paralelo WEKA e VASTOCP ORv3
Nossa maior vantagem — BYOG

Traga sua própria GPU: você compra o hardware, nós operamos enquanto ele for seu

Compre seus servidores NVIDIA GPU de qualquer OEM ou distribuidor autorizado — Dell, Supermicro, GIGABYTE, HPE, Lenovo ou outro. Envie-os diretamente para nossa instalação e nossa equipe de engenharia cuidará da implantação, rede, refrigeração, configuração do cluster, monitoramento e suporte contínuo. Não ganhamos dinheiro com seus servidores. Ganhamos dinheiro mantendo-os funcionando.

Compre de qualquer OEMSeu fornecedor, sua tabela de preços, sua garantia. Não é preciso comprar por meio da gente.
Envie para nósA carga vai direto para nossa doca. Recebemos, inspecionamos, fotografamos e registramos cada número de série.
Nós implantamosRack, energia, refrigeração líquida ou a ar, cabeamento estruturado e fabric otimizado por rail.
Nós validamosLinha de base de firmware, burn-in de 72 horas, benchmarks NCCL, relatório de aceitação assinado.
Nós operamosNOC 24×7, monitoramento, tratamento de RMA com seu OEM, peças e ciclo de vida.

A assistência de compra está disponível — revisão de configuração, comparação neutra de plataformas e informações reais de prazo — mas você nunca precisa comprar hardware pela Velyrix, e seu preço é idêntico nos dois casos.

Infraestrutura de IA completa

Nove formas de trabalhar com a Velyrix

Traga seu próprio hardware para nossas salas, alugue por hora, reserve um cluster privado, deixe que construímos e comissionamos toda a fábrica de IA — ou revenda tudo isso sob sua própria marca.

📦

Traga sua própria GPU

Você compra os servidores NVIDIA de qualquer OEM e mantém o ativo. Nós implantamos, refrigeramos, conectamos, monitoramos e damos suporte — sem margem sobre o hardware e sem amarras.

  • Qualquer OEM ou distribuidor autorizado
  • Instalação que preserva a garantia
  • Assistência de compra opcional
Conhecer o BYOG →

Nuvem GPU

Instâncias NVIDIA GPU sob demanda e reservadas, com treinamento multinó conectado por InfiniBand, Slurm ou Kubernetes, e cobrança por segundo.

  • H100, H200, B200, B300 e GB300
  • Clusters de 8 a 4.096 GPUs
  • Ativação em menos de 90 segundos
Conhecer a nuvem GPU →

Servidores GPU dedicados

Bare metal de inquilino único por mês ou ano. Acesso root, sem custo de hipervisor, sem vizinhos barulhentos, preços publicados com transparência.

  • Nós 8×H100 / H200 / B200
  • A100, L40S, RTX PRO 6000
  • Contratos de 1 a 36 meses
Ver servidores e preços →

Colocation de IA

Traga seus sistemas HGX, DGX, MGX ou GPU de OEM para salas refrigeradas a líquido projetadas para racks de 40 a 160 kW.

  • Ar, RDHx e líquido direto ao chip
  • Jaula, sala privativa ou atacado
  • Suporte local 24×7
Conhecer a colocation →

Implantação e comissionamento de infraestrutura de IA

Construção chave na mão: vistoria de site, montagem em rack, cabeamento de fabric, firmware, burn-in, validação NCCL e testes de aceitação documentados.

  • Entrega de fábricas de IA novas
  • Construção de fabric InfiniBand e Spectrum-X
  • Relatórios de aceitação assinados
Ver o programa de implantação →

Implantação e otimização de LLM privados

Seu próprio endpoint DeepSeek, Qwen, Llama, GPT-OSS, Mistral, GLM, Kimi, MiniMax, Gemma ou Nemotron — ajustado, quantizado e pronto para ambientes isolados.

  • Serviço com vLLM, SGLang e TensorRT-LLM
  • Quantização FP8 / FP4 / AWQ
  • Fine-tuning LoRA e RAG
Implantar um modelo privado →

Armazenamento, rede e operação gerenciada

Sistemas de arquivos paralelos, armazenamento de objetos, trânsito de 400G, interconexão privada e um NOC 24×7 que opera o cluster por você.

  • Camadas WEKA / VAST / Ceph
  • Slurm e Kubernetes gerenciados
  • Observabilidade e relatórios de SLA
Conhecer a plataforma →

Migração, auditoria e ciclo de vida

Mova uma frota GPU em produção entre salas ou provedores, ou peça a uma equipe de engenharia independente que explique por que seu cluster atual rende abaixo do esperado.

  • Migração em fases com mínima interrupção
  • Auditoria de fabric, firmware e MFU
  • Renovação e descomissionamento certificado
Ver serviços de ciclo de vida →
🤝

Parceiros OEM e de canal

Somos a equipe de implantação e suporte por trás do hardware que você vende — sob sua marca, com registro de oportunidade e uma política escrita de neutralidade de canal.

  • Implantação white-label e ATP
  • Suporte L1–L3, RMA e peças
  • Nunca revendemos servidores por conta própria
Programa de parceiros →
A frota Velyrix

Todas as gerações de aceleradores NVIDIA, em um só operador

Da Ampere para inferência otimizada em custo aos racks Blackwell Ultra para treinamento de trilhões de parâmetros, a Velyrix aplica um único modelo operacional a toda a frota — o mesmo projeto de fabric, o mesmo monitoramento, o mesmo SLA.

  • Blackwell Ultra: NVIDIA GB300 NVL72 e HGX B300 em salas refrigeradas a líquido direto ao chip
  • Blackwell: Nós HGX B200 de 8 GPUs com 1,4 TB de HBM3e por nó
  • Hopper: HGX H200 e H100 SXM em escala, disponíveis hoje em todas as regiões
  • Ampere e Ada: A100 80GB, L40S e RTX PRO 6000 Blackwell para inferência e visualização
GB300 NVL72 — rack de 72 GPUs~132 kW
Nó HGX B300 de 8 GPUs~14.3 kW
Nó HGX B200 de 8 GPUs~10.2 kW
Nó HGX H200 de 8 GPUs~10.2 kW
Nó HGX H100 de 8 GPUs~10.2 kW
Nó HGX A100 de 8 GPUs~6.5 kW
L40S / RTX PRO 6000 — 8× PCIe~4.2 kW
Quantum-X800 XDR leaf / spine800G
Ethernet Spectrum-X SN5600800G

Envelopes de potência indicativos por rack e por nó usados para planejamento de capacidade. O consumo real depende do chassi do OEM, do método de refrigeração e do perfil da carga.

Preços indicativos

Preços de GPU transparentes, publicados de antemão

Tarifas iniciais para capacidade de inquilino único. Clusters reservados multinó e contratos de 12 a 36 meses recebem orçamento individual — compromissos maiores ficam bem abaixo destes números.

AceleradorMemóriaSob demandaReserva 6 mesesNó de 8 GPU / mêsStatus
GB300 NVL72288 GB HBM3ea partir de $8.91$8.20Escala rack — sob consultaT4 2026
B300 SXM288 GB HBM3ea partir de $8.34$7.67a partir de $44,800Limitado
B200 SXM180 GB HBM3ea partir de $6.61$6.08a partir de $38,000Disponível
H200 SXM141 GB HBM3ea partir de $3.79$3.49a partir de $23,900Disponível
H100 SXM80 GB HBM3a partir de $3.10$2.85a partir de $18,400Disponível
A100 SXM 80GB80 GB HBM2ea partir de $1.90$1.75a partir de $10,400Disponível

Preços de tabela indicativos em USD, sem impostos, vigentes em setembro de 2026. Os preços variam conforme região, prazo, armazenamento e perfil de tráfego, e são confirmados em orçamento escrito. Veja a tabela de preços completa.

Implantação de LLM privados

Execute modelos de pesos abertos de fronteira dentro do seu próprio perímetro

A Velyrix implanta, quantiza e otimiza as principais famílias de modelos de pesos abertos em hardware dedicado da Velyrix, no seu próprio espaço de colocation ou totalmente isolado on-premise — com uma API compatível com OpenAI e critérios de aceitação medidos em tokens por segundo.

DeepSeekQwen LlamaOpenAI gpt-oss MistralGLM KimiMiniMax GemmaNVIDIA Nemotron
velyrix-inference-endpoint.sh
# Your private endpoint — no data leaves your VPC
curl https://llm.internal.acme.com/v1/chat/completions \
  -H "Authorization: Bearer $VELYRIX_KEY" \
  -d '{
    "model": "deepseek-v3-fp8",
    "messages": [{"role":"user","content":"Summarise Q3 risk report"}],
    "max_tokens": 1024
  }'

# Served by vLLM on 8x NVIDIA H200 — measured at handover
throughput  : 14,850 tok/s aggregate
ttft_p95    : 218 ms
availability: 99.9% monthly SLA
Onde implantamos

25 mercados em 18 países — todos livres de risco de exportação

A Velyrix só instala capacidade em jurisdições onde aceleradores NVIDIA avançados podem ser implantados legalmente e sem risco de licenciamento, dentro de data centers parceiros neutros e auditados de forma independente. Dois mercados estão ativos com capacidade reservada hoje; os demais são entregues sob demanda conforme sua necessidade específica. Dizemos qual é qual antes de qualquer compromisso — veja a tabela de status completa.

Ashburn, VirgíniaAtivo — capacidade reservada
Estados Unidos · até 160 kW
US-EAST-1 · H100 / H200 / B200 / GB300
Dallas, TexasAtivo — capacidade reservada
Estados Unidos · até 160 kW
US-CENTRAL-1 · H200 / B200 / B300
Chicago, IllinoisSob demanda
Estados Unidos · até 80 kW
US-CENTRAL-2 · H100 / H200
Phoenix, ArizonaSob demanda
Estados Unidos · até 80 kW
US-WEST-2 · H100 / A100 / L40S
Santa Clara, CalifórniaSob demanda
Estados Unidos · até 60 kW
US-WEST-1 · H100 / H200
Montreal, QuebecSob demanda
Canadá · até 120 kW
CA-EAST-1 · H100 / H200 / B200
Toronto, OntárioSob demanda
Canadá · até 60 kW
CA-EAST-2 · H100 / L40S
QuerétaroSob demanda
México · até 80 kW
MX-CENTRAL-1 · H100 / H200
MonterreyPrevisto 2027
México · até 120 kW
MX-NORTH-1 · H200 / B200
LondresSob demanda
Reino Unido · até 80 kW
EU-WEST-2 · H100 / H200
DublinSob demanda
Irlanda · até 60 kW
EU-WEST-1 · H100 / L40S
ParisSob demanda
França · até 100 kW
EU-WEST-3 · H200 / B200
FrankfurtSob demanda
Alemanha · até 120 kW
EU-CENTRAL-1 · H200 / B200
AmsterdãSob demanda
Países Baixos · até 60 kW
EU-WEST-4 · H100 / L40S
MadriSob demanda
Espanha · até 80 kW
EU-SOUTH-1 · H100 / H200
MilãoPrevisto 2027
Itália · até 80 kW
EU-SOUTH-2 · H200 / B200
EstocolmoPrevisto 2027
Suécia · até 160 kW
EU-NORTH-1 · B200 / B300
HelsinquePrevisto 2027
Finlândia · até 160 kW
EU-NORTH-3 · B200 / B300
VarsóviaPrevisto 2027
Polônia · até 80 kW
EU-CENTRAL-2 · H100 / H200
TóquioSob demanda
Japão · até 80 kW
AP-NORTHEAST-1 · H100 / H200
OsakaPrevisto 2027
Japão · até 120 kW
AP-NORTHEAST-3 · H200 / B200
SeulSob demanda
Coreia do Sul · até 100 kW
AP-NORTHEAST-2 · H100 / H200
TaipeiSob demanda
Taiwan · até 100 kW
AP-EAST-2 · H100 / H200 / B200
SydneySob demanda
Austrália · até 80 kW
AP-SOUTHEAST-2 · H100 / H200
AucklandPrevisto 2027
Nova Zelândia · até 60 kW
AP-SOUTHEAST-5 · H100 / L40S

"Ativo" significa que a Velyrix tem espaço e energia contratados hoje. "Sob demanda" significa que contratamos espaço conforme sua necessidade específica, somando cerca de duas a seis semanas. "Previsto" significa que ainda está em negociação e não aceitaremos pedidos com base nisso. Todos os mercados desta lista são destinos permitidos para os aceleradores que implantamos, e cada pedido passa por verificação antes do envio; veja conformidade comercial e como escolhemos os países.

Neutralidade de fabricante

Seja o que você comprar, sabemos implantar

A Velyrix mantém manuais de implantação validados — elevação de rack, plano de energia, método de refrigeração, plano de cabeamento e perfil de aceitação — para as plataformas que o mercado realmente entrega.

Dell TechnologiesPowerEdge XE9680 · XE9712
SupermicroSYS-821GE · GB300 NVL72
GIGABYTEG593 · G894 · XL44
HPECray XD670 · XD685
LenovoSR675 V3 · SR685a V3

Também projetos NVIDIA DGX, ASUS, QCT, Wiwynn e Foxconn ORv3. Os nomes de plataforma são marcas de seus respectivos proprietários, citados para descrever nossa capacidade de implantação. Você é OEM, distribuidor ou revendedor? Veja nosso programa de parceiros.

Por que os operadores escolhem a Velyrix

Engenharia de hyperscaler, agilidade de especialista

Semanas, não trimestres

Clusters reservados entregues em 4 a 8 semanas; capacidade sob demanda ativa em minutos. Fábricas de IA novas comissionadas em 12 a 20 semanas.

📊

Throughput útil, não apenas FLOPS

Contratamos com base no throughput útil medido do cluster. Cada entrega inclui números de aceitação de banda NCCL e MFU sustentada — e se não atingirmos o valor acordado, corrigimos por nossa conta.

🔒

Inquilino único por padrão

Hosts dedicados, partições de fabric dedicadas, chaves de criptografia sob guarda do cliente e enclaves isolados opcionais.

Eficiente por projeto

PUE de projeto de 1,15 a 1,25 com refrigeração líquida direta ao chip, reaproveitamento de calor quando possível e contratação de energia renovável.

Preferimos preencher este espaço com compromissos em vez de logotipos. Então eis o que entra no seu contrato: critérios de aceitação medidos e testados antes do pagamento, créditos de serviço aplicados automaticamente sem processo de reclamação, prazos mensais disponíveis na hospedagem BYOG e o telefone direto do engenheiro que construiu seu cluster.

Perguntas frequentes

Posso levar servidores GPU que eu mesmo comprei?

Sim — esse é nosso modelo principal, Traga sua própria GPU. Compre servidores NVIDIA GPU de qualquer OEM ou distribuidor autorizado, envie-os diretamente para uma instalação da Velyrix e nossa equipe de engenharia cuida da implantação, rede, refrigeração, configuração do cluster, monitoramento e suporte contínuo. Você mantém a propriedade, a garantia e o relacionamento com o OEM; a assistência de compra é opcional e nunca obrigatória.

O que é uma neocloud e em que a Velyrix difere de um hyperscaler?

Uma neocloud é um provedor de nuvem criado especificamente para computação acelerada, em vez de TI de propósito geral. A Velyrix opera apenas infraestrutura de IA: salas de alta densidade refrigeradas a líquido, frotas de GPUs NVIDIA, fabrics InfiniBand e Spectrum-X sem perdas e armazenamento paralelo. Esse foco significa maior densidade de GPU por rack, fabrics sem bloqueio como padrão, preços publicados e acesso direto aos engenheiros que construíram seu cluster.

Quais GPUs NVIDIA posso alugar ou hospedar na Velyrix?

A Velyrix suporta sistemas NVIDIA GB300 NVL72, HGX B300, HGX B200, HGX H200, HGX H100, HGX A100, L40S e RTX PRO 6000 Blackwell dos principais OEMs, disponíveis como instâncias de nuvem GPU, servidores dedicados bare metal ou hardware do cliente hospedado em colocation da Velyrix.

Posso levar meus próprios servidores GPU em vez de alugar?

Sim. A colocation da Velyrix é projetada para racks de 40 a 160 kW com ar, trocador de porta traseira e refrigeração líquida direta ao chip, e aceita sistemas HGX, DGX, MGX e OCP ORv3 da Dell, Supermicro, HPE, Lenovo, Gigabyte, QCT e outros. Também podemos implantar e comissionar o hardware por você.

Em quanto tempo um cluster pode ser entregue?

Instâncias de nuvem GPU sob demanda iniciam em menos de 90 segundos. Clusters reservados multinó em uma sala existente costumam estar ativos em 4 a 8 semanas. A construção de uma fábrica de IA nova, incluindo fabric, refrigeração e comissionamento, leva normalmente de 12 a 20 semanas conforme os prazos do hardware.

Vocês ajudam a implantar nosso próprio LLM em vez de usar uma API pública?

Sim. Nosso serviço de Implantação e Otimização de LLM Privados instala, quantiza, mede e opera modelos de pesos abertos como DeepSeek, Qwen, Llama, OpenAI gpt-oss, Mistral, GLM, Kimi, MiniMax, Gemma e NVIDIA Nemotron em infraestrutura que você controla, expostos por uma API compatível com OpenAI e com metas contratadas de throughput e latência.