الرئيسية/سحابة GPU
سحابة GPU والحوسبة الفائقة للذكاء الاصطناعيسحابة NVIDIA GPU، من عقدة واحدة إلى 4,096 وحدة GPU
وفّر مسرّعات NVIDIA أحادية المستأجر بالثانية، أو احجز عنقودًا كاملًا مرتبطًا بـ InfiniBand طوال مدة تدريبك. الأجهزة نفسها، والنسيج نفسه، والمهندسون أنفسهم — مهما كانت طريقة الشراء.
اختر مسرّعك
كل طراز متاح كمثيل مباشر أحادي المستأجر أو كمثيل افتراضي مع تمرير GPU. وتأتي الطرازات متعددة العقد بـ InfiniBand مُحسَّن حسب المسارات افتراضيًا.
| وحدة المعالجة | البنية | الذاكرة / النطاق | الربط البيني | الأنسب لـ | ابتداءً من (لكل ساعة GPU) |
|---|---|---|---|---|---|
| GB300 NVL72 | Blackwell Ultra | 288 GB HBM3e · 8 TB/s | NVLink 5 rack-scale + XDR 800G | تدريب بتريليونات المعاملات واستدلال بسياق طويل | $8.91 |
| B300 SXM (HGX) | Blackwell Ultra | 288 GB HBM3e · 8 TB/s | NVLink 5 + XDR 800G | تدريب مسبق متقدم وضبط دقيق لنماذج MoE | $8.34 |
| B200 SXM (HGX) | Blackwell | 180 GB HBM3e · 8 TB/s | NVLink 5 + NDR/XDR | تدريب واسع النطاق واستدلال FP4 | $6.61 |
| H200 SXM (HGX) | Hopper | 141 GB HBM3e · 4.8 TB/s | NVLink 4 + NDR 400G | تدريب 70B–400B وخدمة عالية الإنتاجية | $3.79 |
| H100 SXM (HGX) | Hopper | 80 GB HBM3 · 3.35 TB/s | NVLink 4 + NDR 400G | تدريب وضبط دقيق واستدلال عام | $3.10 |
| H100 NVL / PCIe | Hopper | 94 / 80 GB · 3.9 TB/s | NVLink bridge + 200G | كثافة استدلال وأحمال مختلطة | $2.70 |
| A100 SXM 80GB | Ampere | 80 GB HBM2e · 2.0 TB/s | NVLink 3 + HDR 200G | تدريب واستدلال دفعي بتكلفة محسّنة | $1.90 |
| A100 SXM 40GB | Ampere | 40 GB HBM2 · 1.6 TB/s | NVLink 3 + HDR 200G | تدريب واستدلال دفعي بتكلفة محسّنة | $1.47 |
| RTX PRO 6000 Blackwell | Blackwell | 96 GB GDDR7 · 1.8 TB/s | PCIe Gen5 · 200G | استدلال ومحاكاة ورسوميات وOmniverse | $2.18 |
| L40S | Ada Lovelace | 48 GB GDDR6 · 864 GB/s | PCIe Gen4 · 100G | استدلال وعرض وفيديو وسطح مكتب افتراضي | $1.35 |
| RTX 5090 | Blackwell | 32 GB GDDR7 · 1.8 TB/s | PCIe Gen5 · 100G | بحث وانتشار وعناقيد تطوير | $0.75 |
أسعار قائمة استرشادية عند الطلب بالدولار الأمريكي لكل ساعة GPU، غير شاملة الضرائب. العقود المحجوزة والملتزم بها تحصل على خصم؛ راجع التسعير لجداول المدد.
اشترِ الحوسبة بالطريقة التي يُموَّل بها مشروعك
عند الطلب
فوترة بالثانية بلا التزام. مثالي للتجريب ومنصات التقييم والضبط الدقيق المؤقت.
- من 1 إلى 8 وحدات GPU لكل مثيل
- توفير فوري عبر الواجهة البرمجية أو لوحة التحكم
- لقطات واستئناف
- بلا رسوم خروج
عناقيد محجوزة
مجموعات مخصصة مرتبطة بـ InfiniBand محجوزة من 1 إلى 36 شهرًا، بسعة مُسمّاة وسعر ثابت طوال المدة.
- من 16 إلى 4,096 وحدة GPU، نسيج بلا اختناق
- Slurm أو Kubernetes مُدار
- حتى 55% أقل من السعر عند الطلب
- ضمان السعة في العقد
سحابة ذكاء اصطناعي خاصة
قاعة ونسيج وتخزين معزولة فيزيائيًا، تشغّلها Velyrix وفق تسمياتك وسياساتك ونظام التدقيق لديك.
- قفص أو جناح مخصص
- مفاتيح تشفير يديرها العميل
- خيار العزل التام
- اتفاقية مستوى خدمة وضبط تغيير مخصصان
شبكات مُحسَّنة حسب المسارات تُبقي وحدات GPU مشغولة
سرعة عنقود التدريب لا تتجاوز سرعة أبطأ عملية all-reduce فيه. تبني Velyrix كل مجموعة متعددة العقد على شجرة fat-tree بلا اختناق ومُحسَّنة حسب المسارات، مع مستويي تخزين وإدارة مخصصين.
- نسيج الحوسبة: NVIDIA Quantum-2 NDR 400G أو Quantum-X800 XDR 800G InfiniBand، باشتراك 1:1
- خيار Ethernet: NVIDIA Spectrum-X مع RoCEv2 وتوجيه تكيّفي وضبط الازدحام
- حوسبة داخل الشبكة: تجميع SHARP لخفض زمن all-reduce في العمليات الجماعية الكبيرة
- مستوى التخزين: شبكة 200/400G منفصلة كي لا تتزاحم نقاط التحقق مع التدرجات
- مستوى الإدارة: شبكة BMC خارج النطاق، معزولة عن حركة المستأجرين
- التحقق: يُبلَّغ عن عرض ناقل NCCL وزمن all-reduce قبل التسليم
# 512x NVIDIA H200 SXM — XDR 800G rail-optimised nccl-tests/all_reduce_perf -b 8 -e 8G -f 2 -g 8 size busbw algbw status 1.00 GB 372.4 GB/s 198.1 GB/s PASS 4.00 GB 381.9 GB/s 203.7 GB/s PASS 8.00 GB 384.6 GB/s 205.1 GB/s PASS fabric : 1:1 non-blocking, 0 link errors / 72h gpu_burnin : 72h @ 100% — 0 XID, 0 ECC row remaps sustained : 48.9% MFU, Llama-class 70B reference run
أرقام تمثيلية من اختبار قبول لدى Velyrix. تختلف النتائج حسب الطوبولوجيا والنموذج وحجم الدفعة وحزمة البرمجيات؛ ويُقاس عنقودك ويُوثَّق بشكل منفصل.
احضر بحزمتك، لا بمشروع ترحيل
Slurm مُدار
Slurm جاهز مع Pyxis/Enroot، ومحاسبة الحصص العادلة، وجدولة واعية بالطوبولوجيا، وخطافات استئناف من نقاط التحقق لعمليات التدريب المسبق الطويلة.
Kubernetes مُدار
عناقيد متوافقة مع CNCF مع NVIDIA GPU Operator وNetwork Operator وملفات MIG وKubeRay وKueue للجدولة متعددة المستأجرين.
واجهة برمجية للأجهزة المباشرة
مزوّد Terraform وواجهة REST لنشر الصور وإقلاع iPXE والتحكم بـ BMC وتقسيم النسيج — ابنِ مستوى تحكمك الخاص فوقها.
سجل الحاويات
سجل وذاكرة تخزين محلية لكل منطقة لـ NGC وDocker Hub والصور الخاصة، كي لا تعرقل تنزيلات بحجم 40 غيغابايت إطلاق مهمة بـ 512 وحدة GPU.
المراقبة
DCGM وPrometheus وGrafana مع استخدام GPU لكل مهمة والطاقة والحرارة وأحداث XID وعدّادات النسيج — قابلة للتصدير إلى نظام SIEM الخاص بك.
أطر العمل
صور مُتحقَّق منها لـ PyTorch وJAX وNeMo وMegatron-LM وDeepSpeed وTorchTitan وvLLM وSGLang وTensorRT-LLM، تُحدَّث شهريًا.
ما تحصل عليه قبل تشغيل أول مهمة
نظام ملفات متوازٍ عالي الأداء (WEKA أو VAST) بحجم يناسب ميزانية الرموز لديك، إضافة إلى تخزين كائنات متوافق مع S3 لمجموعات البيانات ونقاط التحقق. ويشمل 10 تيرابايت NVMe مؤقتة لكل عقدة.
نسيج حوسبة InfiniBand أو Spectrum-X بلا اختناق، ونقل إنترنت مزدوج 100G، وربط خاص مع AWS وAzure وGCP وOracle، وخيارات نقل BGP/IP. بلا رسوم خروج في الخطط القياسية.
مضيفات أحادية المستأجر، وVLAN/VRF وأقسام نسيج معزولة، وتوثيق برامج ثابتة بإقلاع آمن، ومفاتيح يديرها العميل، ومسح كامل موثَّق عند إيقاف التشغيل (تطهير NIST SP 800-88).
مركز عمليات 24×7، ومهندس حلول مُسمّى، واستجابة P1 خلال 15 دقيقة، وهدف استبدال الأجهزة خلال أربع ساعات في الموقع، وتقارير شهرية لمستوى الخدمة مقابل التوافر المتعاقد عليه.
قبل التسليم: اختبار تحميل GPU لمدة 72 ساعة، والتحقق من الذاكرة وECC، واختبارات عرض NCCL، ومسح أخطاء النسيج، وتقرير قبول موقَّع يمكنك تسليمه لمدققيك.
وحدات المعالجة ملكك. ونحن نشغّلها.
اشترِ خوادم NVIDIA من أي شركة مصنّعة أو موزّع معتمد، وأرسلها مباشرة إلى مركز بيانات Velyrix، ونتولى نحن الباقي: التركيب والشبكة والتبريد والمراقبة والدعم المستمر. أو استأجر خوادمنا. في الحالتين تحصل على خطة خلال يوم عمل واحد.
الأسئلة الشائعة
كيف تُفوتر سحابة GPU من Velyrix؟
تُفوتر المثيلات عند الطلب بالثانية بلا حد أدنى للمدة وبلا رسوم خروج بيانات في الخطط القياسية. وتُفوتر العناقيد المحجوزة شهريًا بسعر تعاقدي ثابت لمدد من شهر إلى ستة وثلاثين شهرًا. وتُسعَّر السحب الخاصة للمؤسسات كرسم منصة شهري ثابت إضافة إلى السعة.
هل أحصل على أجهزة مباشرة أم آلات افتراضية؟
كلاهما متاح. الوضع الافتراضي للتدريب متعدد العقد هو أجهزة مباشرة أحادية المستأجر مع وصول مباشر إلى وحدات GPU وبطاقات الشبكة وNVMe. وتُقدَّم المثيلات الافتراضية مع تمرير GPU حين تكون اللقطات وإعادة التهيئة السريعة أهم من النسب المئوية الأخيرة من الأداء.
ما الشبكة التي تستخدمها عناقيد التدريب متعددة العقد؟
InfiniBand بلا اختناق ومُحسَّن حسب المسارات - NVIDIA Quantum-2 NDR بسرعة 400G أو Quantum-X800 XDR بسرعة 800G لكل وحدة GPU - مع تقليص SHARP داخل الشبكة. ويتوفر NVIDIA Spectrum-X Ethernet مع RoCEv2 حين يُشترط نموذج تشغيل قائم على Ethernet فقط.
هل يمكنني تشغيل Slurm وKubernetes على العنقود نفسه؟
نعم. تقسّم Velyrix عادةً عنقودًا محجوزًا بحيث يتولى قسم Slurm عمليات التدريب الطويلة بينما يخدم قسم Kubernetes الاستدلال، مع نظام ملفات متوازٍ مشترك بينهما. ويمكن تعديل أحجام الأقسام خلال المدة.
هل هناك حد أدنى للالتزام في العناقيد الكبيرة؟
تُتعاقد العناقيد التي تتجاوز 256 وحدة GPU عادةً لثلاثة أشهر على الأقل بسبب أعمال بناء النسيج والكبلات. ويمكن استيعاب فترات أقصر في القاعات التي يوجد فيها مجموعة مماثلة مبنية وغير مستخدمة.