الذكاء الاصطناعي
DeepSeek تطلق نماذج V4 بـ 1.6 تريليون معلمة
أطلقت DeepSeek نموذجي V4 Flash وPro، اللذين يتميزان بما يصل إلى 1.6 تريليون معلمة، وتدّعي أنهما يكادان يغلقان فجوة الأداء مع نماذج الذكاء الاصطناعي الرائدة.
أطلقت مختبرات الذكاء الاصطناعي الصينية DeepSeek نسختين تجريبيتين من أحدث نماذجها اللغوية الكبيرة، DeepSeek V4، وهما: DeepSeek V4 Flash وV4 Pro. يمثل هذا الإطلاق تحديثاً لنموذج V3.2 السابق للمختبر. ووفقاً لـ DeepSeek، فإن كلا النموذجين يعتمدان على بنية “خليط الخبراء” (mixture-of-experts) — وهي بنية نموذج ذكاء اصطناعي لا تُفعّل سوى مجموعة فرعية من المعلمات لكل مهمة لخفض تكاليف الاستدلال — مع نوافذ سياق تبلغ 1 مليون رمز (token). وتؤكد DeepSeek أن النموذجين قد أغلقا الفجوة تقريباً مع النماذج الرائدة الحالية في معايير الاستدلال. ومع ذلك، أشار المختبر إلى أن النماذج تظهر “مساراً تطويرياً يتأخر عن نماذج الذكاء الاصطناعي الرائدة المتطورة بما يقرب من 3 إلى 6 أشهر”.
يتميز نموذج Pro بإجمالي 1.6 تريليون معلمة، مع 49 مليار معلمة نشطة، مما يجعله أكبر نموذج مفتوح الأوزان (open-weight) متاح. وهذا يتفوق على المنافسين مثل نموذج Kimi K 2.6 من شركة Moonshot AI، الذي يحتوي على 1.1 تريليون معلمة، ونموذج M1 من شركة MiniMax، الذي يحتوي على 456 مليار معلمة. كما أنه يمثل أكثر من ضعف عدد معلمات نموذج V3.2 السابق من DeepSeek، والذي يحتوي على 671 مليار معلمة. وبالمقارنة، يحتوي نموذج V4 Flash الأصغر على 284 مليار معلمة، مع 13 مليار معلمة نشطة.
يتم تسويق كلا النموذجين كبدائل ميسورة التكلفة للغاية لنماذج أخرى في السوق، بأسعار تقل عن أسعار النماذج الرائدة الرئيسية من منافسين مثل Google وOpenAI. ووفقاً لهيكل تسعير DeepSeek، فإن تكاليف النماذج الجديدة هي كما يلي:
- V4 Flash: تكلف 0.14 دولار لكل مليون رمز إدخال و0.28 دولار لكل مليون رمز إخراج.
- V4 Pro: تكلف 0.145 دولار لكل مليون رمز إدخال و3.48 دولار لكل مليون رمز إخراج.
يأتي الإطلاق في 2026-04-24 وسط تدقيق جيوسياسي وصناعي متزايد. ففي اليوم السابق للإطلاق، اتهمت الولايات المتحدة الصين بسرقة الملكية الفكرية لمختبرات الذكاء الاصطناعي الأمريكية على نطاق صناعي باستخدام آلاف الحسابات الوكيلة. علاوة على ذلك، واجهت DeepSeek نفسها اتهامات من شركتي Anthropic وOpenAI بـ “التقطير” (distilling)، وهو ما يعني جوهرياً نسخ نماذج الذكاء الاصطناعي الخاصة بهم. ويُعرّف التقطير بأنه عملية تدريب نموذج أصغر باستخدام مخرجات نموذج أكبر وموجود مسبقاً.
لماذا يهم
تقدم نماذج V4 الجديدة من DeepSeek نموذجاً مفتوح الأوزان بـ 1.6 تريليون معلمة، وتدّعي أنها تغلق فجوة الأداء مع النماذج الرائدة مع تقويضها بشكل كبير من حيث السعر.