جدول المحتويات
نظرة على تقدم NVIDIA في استنتاجات Vera Rubin مع منصات LPX و CPX لأداء أسرع في الذكاء الاصطناعي وتكاليف رمزية أقل
تتجه صناعة الذكاء الاصطناعي نحو عصر جديد، حيث لن يعتمد هذا العصر على شريحة واحدة أو نظام معين، بل على كيفية تكامل جميع مكونات “مصنع الذكاء الاصطناعي”. في هذا السياق، أعلنت NVIDIA عن توسيع نظام Vera Rubin NVL72، مع تحسينات في سرعة توليد الرموز لأنظمة الذكاء الاصطناعي الفعالة.
أعلنت NVIDIA اليوم عن بدء الإنتاج الكامل لنظام NVIDIA Groq 3 LPX، الذي يتمتع بسرعة غير مسبوقة. في اختبار أداء يعتمد على نموذج Gemma 4 31B، حقق النظام 3400 رمزاً في الثانية، مما يجعله أسرع بأربع مرات من أقرب منصة منافسة. هذه السرعة تجعل النظام مثالياً للاستخدامات التي تتطلب معالجة سياقات طويلة تصل إلى 100,000 رمز.
تتبنى الشركات العالمية حلول منصة Vera Rubin. على سبيل المثال، أعلنت SpaceXAI أن وحدات المعالجة المركزية من NVIDIA Vera ستدعم الجيل القادم من الذكاء الاصطناعي الفعال. كما قامت CoreWeave بنشر نظام Spectrum-X Multiplane، الذي يربط بين وحدات Vera Rubin باستخدام مفاتيح متعددة لتوفير شبكات ذكاء اصطناعي عالية النطاق وعالية الكفاءة. Nebius هو أول سحابة ذكاء اصطناعي تعتمد على NVIDIA Groq 3 LPX.
مع تحول الذكاء الاصطناعي من التدريب إلى الاستنتاج، أصبحت الحاجة إلى بنية تحتية جديدة ضرورية. تتطلب الأنظمة الذكية معالجة عدد أكبر من الرموز وسياقات أكبر، مما يستدعي تحسين الأداء والسرعة والتكلفة بشكل غير مسبوق.
تصميم متكامل لتحسين الأداء
يعتمد تصميم NVIDIA على مبدأ “التصميم المتكامل”. تم هندسة Vera Rubin لتسريع الاستنتاجات بينما تتعامل الأنظمة الذكية مع تسلسلات طويلة. يضمن نظام NVIDIA Spectrum-X Ethernet تدفق البيانات بكفاءة عبر المصانع الذكية، بينما تم تصميم NVIDIA Groq 3 LPX لتوليد الرموز بسرعة فائقة. معًا، يوضحان كيفية تحسين كل مرحلة من مراحل عملية الذكاء الاصطناعي، بدءًا من معالجة السياقات وصولاً إلى توليد الرموز.
تقدم NVIDIA Groq 3 LPX بنية استنتاج منخفضة الكمون، مما يساعد المؤسسات ومزودي السحابة على تحقيق الأداء المطلوب لتطبيقات الذكاء الاصطناعي الفعالة.
شركاء NVIDIA يعتمدون على Vera Rubin لتقليل تكاليف الرموز
تعتبر Nebius، السحابة الرائدة في الذكاء الاصطناعي، أول من يعتمد على NVIDIA Groq 3 LPX، مما يمنح المطورين إمكانية الوصول إلى سرعات توليد رموز رائدة. سيساهم دمج NVIDIA Groq 3 LPX مع نظام Vera Rubin NVL72 في تحسين أداء الاستنتاج، مما يمكّن المطورين من بناء أنظمة تفاعلية في الوقت الحقيقي.
SpaceXAI تعتمد وحدات المعالجة المركزية من NVIDIA Vera للذكاء الاصطناعي الفعال
تخطط SpaceXAI لبناء وتوسيع بنيتها التحتية للذكاء الاصطناعي حول نظام Vera Rubin، من مراكز البيانات على الأرض إلى الأقمار الصناعية. ستساعد وحدات المعالجة المركزية من NVIDIA Vera في تسريع الأعمال المعقدة المتعلقة بالذكاء الاصطناعي، مثل التنسيق ومعالجة البيانات.
NVIDIA Groq 3 LPX: مسرع استنتاج الذكاء الاصطناعي التفاعلي
تم تصميم NVIDIA Groq 3 LPX بالتعاون مع منصة Vera Rubin NVL72، مما يساعد المصانع الذكية على تقديم الرموز بأقل زمن استجابة. يتعامل النظام مع التحديات الجديدة التي تطرأ على الذكاء الاصطناعي، حيث يتم توليد الاستجابات بشكل تدريجي، مما يتطلب استجابة سريعة.
بناء مصنع الرموز
مع تحول الصناعة من تدريب النماذج إلى تقديم الذكاء على نطاق واسع، يجب أن تتطور البنية التحتية لتصبح “مصنع رموز” قادرًا على تقديم الأداء والكفاءة الاقتصادية. تم تصميم NVIDIA Groq 3 LPX لتلبية هذه المتطلبات، مما يضمن استجابة سريعة حتى عبر سياقات ضخمة.
رأي بوابة الذكاء الاصطناعي
تظهر الابتكارات الأخيرة من NVIDIA في مجال الذكاء الاصطناعي كيف يمكن للتصميم المتكامل أن يحسن الأداء والكفاءة. مع تزايد الطلب على الأنظمة الذكية، هل تعتقد أن هذه التطورات ستغير مستقبل الذكاء الاصطناعي بشكل جذري؟
المصدر: الرابط الأصلي