شريحة NVIDIA بقيمة 20 مليار دولار قد تجعل ChatGPT يبدو بطيئاً

- تستعد NVIDIA للكشف عن شريحة استدلال ذكاء اصطناعي جديدة في مؤتمر NVIDIA GTC السنوي، مصممة لتوليد استجابات أسرع من الأنظمة الحالية مثل ChatGPT.
- تركز الشريحة على الاستدلال بالذكاء الاصطناعي وتأتي بعد صفقة إنفيديا التي تبلغ حوالي 20 مليار دولار لترخيص التكنولوجيا وجلب مؤسسي Groq.
- يتوقع المحللون أن يهيمن استدلال الذكاء الاصطناعي على الإنفاق المستقبلي في مراكز البيانات، حتى مع قيام منافسين مثل Meta Platforms بتطوير معالجات استدلال خاصة بهم.
عملاق الشرائح NVIDIA يستعد للكشف عن معالج ذكاء اصطناعي جديد قوي مصمم لتسريع كيفية توليد روبوتات الدردشة وأدوات الذكاء الاصطناعي الأخرى للاستجابات، مما قد يجعل الأنظمة الحالية مثل ChatGPT تبدو بطيئة بالمقارنة.
المنصة الجديدة، المتوقعة أن تظهر في مؤتمر مطوري GTC السنوي لشركة NVIDIA، محسّنة لاستدلال الذكاء الاصطناعي، وهي المرحلة التي تنتج فيها النماذج المدربة إجابات على مطالبات المستخدمين. وعلى عكس وحدات معالجة الرسومات التقليدية المصممة للتعامل مع كل من التدريب والاستدلال، يركز المعالج القادم بشكل محدد على تقديم استجابات أسرع وأكثر كفاءة.
المنتج، إذا تم إطلاقه، سيمثل أول نتيجة ملموسة لاتفاق ديسمبر الذي جلب مؤسسي Groq إلى الحظيرة، والتي تتخصص في أجهزة معالجة الذكاء الاصطناعي عالية السرعة.
في أواخر العام الماضي، أنفقت NVIDIA reportedly حوالي 20 مليار دولار لترخيص التكنولوجيا من شركة الشرائح الناشئة Groq وتوظيف الموظفين الرئيسيين، بما في ذلك الرئيس التنفيذي. وفي الوقت نفسه، قال الرئيس التنفيذي لشركة NVIDIA، جينسن هوانغ، للموظفين: "نخطط لدمج معالجات Groq منخفضة زمن الوصول في بنية مصنع الذكاء الاصطناعي الخاص بـ NVIDIA، مما يوسع المنصة لخدمة مجموعة أوسع من أعباء عمل استدلال الذكاء الاصطناعي والوقت الفعلي."
الآن، من المتوقع أن يتعامل شريط الاستدلال الجديد مع استعلامات الذكاء الاصطناعي المعقدة بسرعة عالية، مع تضع OpenAI وعملاء رائدين آخرين على الأرجح لتبنيه، وفقاً لجريدة وول ستريت جورنال. أظهر تقريره أيضاً أن الشريحة الجديدة قد تتعامل مع ما يقرب من 10% من عبء عمل الاستدلال الخاص بـ OpenAI.
ستستخدم شريحة على طراز Groq ذاكرة الوصول العشوائي الثابتة (SRAM)، وفقاً للمصادر
أثناء مكالبة أرباح حديثة، أشار الرئيس التنفيذي لشركة NVIDIA إلى أن عدة منتجات جديدة سيتم الكشف عنها في حدث GTC القادم، الذي يوصف غالباً بـ "سوبر بول الذكاء الاصطناعي". وقد علّق قائلاً: "لدي بعض الأفكار الرائعة التي أود مشاركتها معكم في GTC."
يتفق معظم المحللين على أن شريحة على طراز Groq قد تكون جزءاً من التشكيلة. كما صرحوا بأن تصميمها قد يلقي الضوء على كيفية محاولة NVIDIA معالجة قيود الذاكرة في حوسبة الاستدلال. عادةً ما تعمل مثل هذه المنصات على ذاوية عالية النطاق الترددي (HBM). ومع ذلك، كان من الصعب الحصول على HBM مؤخراً.
أفاد الداخلون أن زعمت الشركة تخطط لاستخدام ذاكرة الوصول العشوائي الثابتة (SRAM) في الشريحة بدلاً من ذاوية الوصول العشوائي الديناميكية المرتبطة بـ HBM. مثالياً، SRAM أكثر سهولة ويمكن أن تحسن أداء أعباء عمل استدلال الذكاء الاصطناعي.
إذا تم الكشف عن الشريحة، فقد تكون خطوة كبيرة للأمام لشركة الشرائح والنماذج المدربة بالذكاء الاصطناعي. ومع ذلك، تحدثاً عن إطلاقها المحتمل، ألقت Sid Sheth، مؤسس ومدير d-Matrix، بظلال على تطويرها. لاحظ أن NVIDIA تظل القائد الواضح في تدريب الذكاء الاصطناعي، لكن الاستدلال يمثل مشهداً مختلفاً تماماً. شارك قائلاً: "يمكن للمطورين اللجوء إلى منافسين غير NVIDIA لأن تشغيل نماذج الذكاء الاصطناعي النهائية لا يتطلب نفس نوع البرمجة اللازمة لتدريبها."
ومع ذلك، تتقدم عمالقة التكنولوجيا الآخرين أيضاً في حوسبة الاستدلال. كشفت Meta هذا الأسبوع عن أربعة معالجات مصممة خصيصاً للاستدلال، مما دفع مستثمر وادي السيليكون إلى القول إن الصناعة قد تدخل مرحلة غير مهيمنة عليها من قبل "NVIDIA".
ومع ذلك، مؤخراً، June Paik، الرئيس التنفيذي لشركة FuriosaAI، منافس NVIDIA، تعليقه على فائدة حوسبة الاستدلال القابلة للنشر بسهولة، حذر من أن معظم مراكز البيانات لا يمكنها استيعاب أحدث وحدات معالجة الرسومات المبردة بالسوائل.
ومع ذلك، على الرغم من مخاوفه، يتوقع محللو بنك أوف أمريكا أن تمثل أعباء عمل الاستدلال 75% من إنفاق مراكز بيانات الذكاء الاصطناعي بحلول عام 2030، عندما يصل السوق إلى حوالي 1.2 تريليون دولار، مقارنة بـ 50% تقريباً العام الماضي./assert Ben Bajarin، محلل التكنولوجيا في Creative Strategies، أيضاً أن مراكز بيانات المستقبل لن تتوافق مع نموذج واحد يناسب الجميع، متوقعاً أن تتخذ الشركات نهجاً مختلفاً في تطوير الشرائح والمرافق.
من المتوقع أن تطلق NVIDIA شرائح Vera Rubin في وقت لاحق من 2026
كما أطلقت NVIDIA مؤخراً شرائح الذكاء الاصطناعي من الجيل التالي، شرائح Vera Rubin AI، متوقعة أن يؤدي ظهور منصات الذكاء الاصطناعي الاستدلالية مثل DeepSeek إلى زيادة الطلب على الحوسبة بشكل أكبر. وزعمت أن الشرائح ستساعد في تدريب نماذج ذكاء اصطناعي أكبر وتوفير مخرجات أكثر تعقيداً لجمهور أوسع من المستخدمين.
ووفقاً لهوانغ، ستصل Rubin أيضاً إلى السوق في النصف الثاني من عام 2026، مع إصدار "ultra" عالي الأداء في عام 2027.
كما أوضح أن نظام Rubin واحد سيجمع 576 وحدة معالجة رسومات فردية في شريحة واحدة. حالياً، تجمع شرائح Blackwell من NVIDIA 72 وحدة معالجة رسومات في نظام NVL72، مما يعني أن Rubin ستتميز بذاكرة أكثر تقدماً.
لا تكتفِ بقراءة أخبار العملات الرقمية فحسب، بل افهمها. اشترك في نشرتنا الإخبارية. مجانية.

نيليوس إيرين
نيليوس خريجة إدارة الأعمال وتكنولوجيا المعلومات ولديها خمس سنوات من الخبرة في صناعة العملات المشفرة. وهي أيضًا خريجة برنامج بيتكوين دادا. ساهمت نيليوس في أبرز وسائل الإعلام، بما في ذلك بانكليس تايمز وكريبتوبيسيك ورايز أب ميديا.
















