النقص في 2026: ما حدث ولماذا
لم ينتهِ نقص حوسبة GPU الذي بدأ في أواخر 2022. بل تطور. في 2026، لم يعد عنق الزجاجة هو تصنيع شرائح GPU — فقد وسّعت NVIDIA وTSMC الإنتاج بشكل كبير. انتقل عنق الزجاجة إلى المنبع إلى الذاكرة: تحديداً ذاكرة النطاق الترددي العالي (HBM)، الذاكرة المتخصصة التي يحتاجها كل مسرّع ذكاء اصطناعي حديث.
النقص نتيجة تصادم بين قوتين:
طلب ذكاء اصطناعي متفجر. شركات السحابة الكبرى (Microsoft وGoogle وAmazon وMeta) وبرامج الذكاء الاصطناعي السيادي وعمليات النشر المؤسسية تطلب مجتمعة ملايين مسرّعات الذكاء الاصطناعي سنوياً. كل H100 يحتاج 80GB من HBM3، وكل Blackwell B200 يحتاج 192GB من HBM3e. نما إجمالي طلب HBM 5 أضعاف بين 2023 و2026.
إمداد ذاكرة مقيد. تُصنّع HBM بواسطة ثلاث شركات فقط — SK Hynix وSamsung وMicron — باستخدام عمليات متخصصة لا يمكن تسريعها بسهولة. يتطلب إنتاج HBM مساحة سيليكون أكبر 2–3 أضعاف لكل جيجابايت من DRAM القياسية، ويستخدم تغليفاً متقدماً (تكديس الشرائح مع TSV)، ولديه عوائد تصنيع أقل.
النتيجة: نمو الطلب تجاوز بكثير توسع العرض، مما أوجد نقصاً يصفه مصنعو الذاكرة بأنه الأطول في تاريخ الصناعة.
HBM: عنق الزجاجة وراء أزمة GPU
ما يجعل HBM مختلفة
HBM ليست ذاكرة عادية. توفر النطاق الترددي الشديد الذي تحتاجه مسرّعات الذكاء الاصطناعي لتغذية البيانات لآلاف نوى الحوسبة:
| الميزة | DRAM القياسية (DDR5) | HBM3 | HBM3e |
|---|---|---|---|
| النطاق الترددي | 38–51 GB/s لكل وحدة | 819 GB/s لكل حزمة | 1,200 GB/s لكل حزمة |
| الهيكل | شريحة واحدة | 8–12 شريحة مكدسة | 8–12 شريحة مكدسة |
| التغليف | تركيب PCB قياسي | 2.5D/3D مع interposer | 2.5D/3D مع interposer |
| مساحة الشريحة لكل GB | ~1× (خط الأساس) | ~2.5× | ~2.5× |
| عائد التصنيع | 85–95% | 60–75% | 55–70% |
| السعر لكل GB | ~3 دولار | ~15–20 دولار | ~20–30 دولار |
عنق الزجاجة الرئيسي: تتطلب HBM تكديس 8–12 شريحة DRAM فوق بعضها باستخدام ثقوب السيليكون (TSVs)، ثم ربط الحزمة بـ interposer بجانب شريحة GPU. كل خطوة تكديس تُسبب فقد في العائد. شريحة معيبة واحدة في حزمة من 12 شريحة تُلغي الحزمة بأكملها.
فجوة العرض والطلب
ينمو طلب HBM بنحو 80–100% سنوياً مدفوعاً بنشر مسرّعات الذكاء الاصطناعي. ينمو العرض بنحو 50–60% سنوياً مع إضافة المصنعين للسعة. الفجوة تتقلص لكنها لن تُغلق تماماً حتى 2028–2029 بمعدلات الاستثمار الحالية.
كيف يستنزف طلب الذكاء الاصطناعي إمداد GPU الاستهلاكية
لنقص HBM تأثير مباشر ومرئي على توفر GPU الاستهلاكية. أفادت التقارير أن NVIDIA خفضت إنتاج RTX 50-series (Blackwell الاستهلاكي) بنسبة 30–40% في النصف الأول من 2026 لأن نفس طاقة تصنيع الذاكرة التي تنتج GDDR7 الاستهلاكية تغذي أيضاً خطوط إنتاج HBM.
مشكلة تخصيص الذاكرة
يواجه مصنعو الذاكرة قرار تخصيص محصلته صفر: كل رقاقة سيليكون DRAM يمكن استخدامها إما لـ GDDR الاستهلاكية أو HBM للذكاء الاصطناعي. تفرض HBM أسعاراً أعلى 5–10 مرات لكل جيجابايت وتأتي مع عقود طويلة الأجل من عملاء السحابة الكبار. قرار الأعمال واضح — أعطِ الأولوية لـ HBM.
العواقب على المستهلكين ومستخدمي GPU غير المتعلقة بالذكاء الاصطناعي:
- أسعار GPU استهلاكية أعلى. إنتاج أقل لـ GDDR يعني تكاليف ذاكرة أعلى لبطاقات الألعاب
- توفر محدود. تظل بطاقات RTX 50-series صعبة الشراء بسعر التجزئة المقترح
- دورات منتج أطول. لدى NVIDIA حافز أقل لتحديث خطوط GPU الاستهلاكية عندما تولد مسرّعات الذكاء الاصطناعي هوامش أعلى
للاطلاع على مقارنة أعمق بين نماذج GPU عبر أحمال عمل الذكاء الاصطناعي، راجع نظرة عامة على GPU.
استجابة سلسلة التوريد: أكثر من 50 مليار دولار في استثمارات مصانع جديدة
يستجيب مصنعو الذاكرة بأكبر استثمار رأسمالي في تاريخ DRAM. يتجاوز إجمالي الاستثمار الملتزم عبر الموردين الثلاثة لـ HBM 50 مليار دولار.
| المُصنّع | حصة سوق HBM (2026) | الاستثمار المعلن | جدول السعة الجديدة |
|---|---|---|---|
| SK Hynix | ~53% | 18+ مليار دولار (مصانع جديدة في كوريا والولايات المتحدة) | النصف الثاني 2027 – النصف الأول 2028 |
| Samsung | ~35% | 17+ مليار دولار (توسعة في كوريا وتكساس) | النصف الأول 2028 |
| Micron | ~12% | 15+ مليار دولار (مصنع Idaho الجديد، توسعة اليابان) | النصف الثاني 2027 – 2028 |
لماذا يستغرق الأمر وقتاً طويلاً
يتطلب مصنع أشباه موصلات جديد 18–24 شهراً للبناء والتجهيز، يليها 6–12 شهراً لتأهيل الإنتاج — مما يعني أن الاستثمارات في 2026 لن تنتج HBM بالحجم حتى 2028 على أبكر تقدير.
التأثير على أسعار GPU: أسعار السوق والسحابة
يؤثر نقص HBM مباشرة على ما تدفعه مقابل حوسبة GPU.
أسعار الأجهزة
استقرت أسعار H100 في السوق الثانوية بدلاً من الانخفاض، رغم توفر GPU Blackwell. في دورة GPU عادية، ينخفض الجيل السابق بنسبة 30–50% عند إطلاق جيل جديد. تحدّى H100 هذا النمط.
أسعار السحابة والسوق
| GPU | السعر المتوقع (بدون نقص) | السعر الفعلي (2026) | العلاوة |
|---|---|---|---|
| H100 80GB (سحابة) | 2.00–3.00 دولار/ساعة | 2.50–4.00 دولار/ساعة | +25–33% |
| H100 80GB (سوق) | 1.00–1.50 دولار/ساعة | 1.30–2.00 دولار/ساعة | +30% |
| A100 80GB (سوق) | 0.50–0.80 دولار/ساعة | 0.70–1.20 دولار/ساعة | +40% |
| B200 (سحابة) | 3.50–5.00 دولار/ساعة | 4.50–7.00 دولار/ساعة | +30–40% |
تحافظ أسعار السوق على علاوة 25–40% فوق ما هو متوقع بناءً على منحنيات استهلاك الأجهزة. يُمدد النقص فعلياً فترة الإيرادات العالية لمشغلي GPU. لأسعار شاملة عبر المزودين، راجع مقارنة أسعار GPU السحابية.
الجدول الزمني: متى سيلحق العرض بالطلب؟
بناءً على استثمارات المصانع المعلنة وجداول بنائها:
أواخر 2027: أول سعة HBM جديدة مهمة تدخل الخدمة من توسعات SK Hynix وMicron.
2028: مصانع Samsung وSK Hynix الإضافية تصل لإنتاج الحجم. نمو إمداد HBM يتسارع ليتناسب مع نمو الطلب.
2028–2029: العرض والطلب يصلان لتوازن تقريبي. أسعار GPU تبدأ في اتباع منحنيات الاستهلاك الطبيعية.
بطاقة مجهولة — متطلبات ذاكرة GPU الجيل التالي: قد تتطلب بنية Rubin من NVIDIA (المتوقعة 2027–2028) المزيد من HBM لكل GPU (256GB+)، مما قد يمدد النقص.
نقطة أساسية: النقص ليس دائماً، لكنه سيستمر لمدة 2–3 سنوات أخرى. مشغلو GPU الذين حصلوا على أجهزة قبل أسوأ فترات النقص يستفيدون من أسعار تأجير مرتفعة طوال المدة.
ما يجب على مشتري ومستأجري GPU فعله الآن
إذا كنت تشتري GPU
اشترِ أجهزة الجيل الحالي الآن إذا كان لديك طلب. الانتظار لانخفاض الأسعار قد يكلف أكثر في إيرادات التأجير المفقودة من توفير الأجهزة. بأسعار السوق الحالية، تُسدد أجهزة H100 في 18–24 شهراً.
فكّر في A100 المستعملة للاستدلال. GPU A100 80GB بالأسعار المستعملة الحالية (8,000–12,000 دولار) تقدم تكلفة ممتازة لكل رمز في الاستدلال وأكثر توفراً من H100.
إذا كنت تستأجر حوسبة GPU
ثبّت أسعاراً محجوزة إذا كان حجم عملك متوقعاً. خلال النقص، أسعار Spot متقلبة وتميل للارتفاع.
استخدم أسواق GPU لتوفير التكاليف. أسعار السوق عادة أقل بنسبة 40–60% من أسعار مزودي السحابة الكبار حتى خلال النقص.
فكّر في أجهزة مُحسّنة للاستدلال. GPU L40S وL4 أقل تأثراً بنقص HBM وتقدم أداء استدلال تنافسي.
للاطلاع على إطار قرار شامل حول شراء أو تأجير أو استئجار حوسبة GPU، راجع دليل تمويل GPU.
الأسئلة الشائعة
ما هي HBM ولماذا هي مهمة لـ GPU؟
HBM (ذاكرة النطاق الترددي العالي) هي نوع متخصص من DRAM يوفر نطاقاً ترددياً أعلى 10–30 مرة من ذاكرة DDR5 القياسية. تحتاج مسرّعات الذكاء الاصطناعي مثل H100 وB200 هذا النطاق الترددي الشديد لتغذية البيانات لنوى الحوسبة بسرعة كافية. HBM هي المكوّن الأكثر ندرة في سلسلة إمداد أجهزة الذكاء الاصطناعي.
لماذا لا يزال هناك نقص في GPU في 2026؟
انتقل النقص من تصنيع شرائح GPU (التي وسّعتها NVIDIA وTSMC) إلى ذاكرة HBM. ينمو طلب HBM بنسبة 80–100% سنوياً بينما ينمو العرض بنسبة 50–60%. ثلاثة مصنعين فقط (SK Hynix وSamsung وMicron) ينتجون HBM، وتوسيع الإنتاج يتطلب بناء مصانع جديدة يستغرق 18–24 شهراً.
كيف يؤثر النقص على أسعار سوق GPU؟
أسعار تأجير GPU في الأسواق أعلى بنسبة 25–40% مما ستكون عليه بدون النقص. استقرت أسعار H100 الفورية بدلاً من الانخفاض مع إطلاق Blackwell.
متى ستنخفض أسعار GPU؟
يُتوقع تخفيف كبير في الأسعار في أواخر 2027 إلى 2028 مع دخول سعة إنتاج HBM الجديدة. ومع ذلك، إذا تطلبت GPU الجيل التالي (بنية Rubin) ذاكرة أكثر لكل شريحة، فقد يمتد النقص أكثر.
هل يجب أن أنتظر شراء أجهزة GPU حتى تنخفض الأسعار؟
للمشغلين الذين لديهم طلب فوري لتوليد الإيرادات، الانتظار عادة أكثر تكلفة من الشراء الآن. إيرادات التأجير المكتسبة خلال فترة الانتظار غالباً ما تتجاوز التوفيرات المحتملة في الأجهزة.