أطلقت DeepSeek نموذجًا جديدًا يعالج مليون رمز سياقي مع تفعيل عدد أقل من المعلمات مقارنة ببعض النماذج مفتوحة المصدر التي أُطلقت قبل عامين. ويمثل V4.1-Flash، الذي أُطلق في 10 سبتمبر، أحدث محاولة من قبل الشركة الناشئة الصينية للذكاء الاصطناعي لإعادة كتابة اقتصاديات نماذج اللغة الكبيرة.
يحتوي النموذج على 552 مليار معلمة ضمن بنية مزيج من الخبراء (MoE)، لكنه يُفعّل فقط حوالي 8 مليارات منها للمهام الإدخالية و16 مليارًا للمخرجات. النتيجة هي نموذج يتفوق بكثير على ما يوحي به حجم حساباته النشطة.
الهندسة التي تجعلها تعمل
يقدم V4.1-Flash ما يسميه DeepSeek معمارية مُشفِّر-مُفكِّك سببية غير متماثلة، تُعالج المدخلات وتُولِّد المخرجات عبر مسارات مختلفة مُحسَّنة لكل مهمة، بدلاً من تشغيل كل شيء عبر أنبوب واحد.
يتمدد نافذة السياق إلى مليون رمز. دعم هذا السياق الضخم يتطلب ذاكرة تخزين مؤقت KV تستهلك حوالي 890 بايت لكل رمز، أي حوالي ربع ما كان يتطلبه النموذج السابق V4-Flash.
إن تقليل هذا التخزين المؤقت أهم مما قد يبدو. إن ذاكرة KV هي العقدة الذاكرة التي تحدد عدد المستخدمين المتزامنين الذين يمكن للنموذج خدمتهم ومدة استمرار محادثاتهم. إن خفضها بنسبة 75% يعني أن المشغلين يمكنهم خدمة أربع مرات عدد المستخدمين على نفس الأجهزة، أو التعامل مع سياقات أطول بأربع مرات دون ترقية مجموعات GPU الخاصة بهم.
في المقاييس، تدّعي DeepSeek أن V4.1-Flash يتفوق على نموذج V4-Pro الخاص بالشركة ويتنازع مباشرةً مع GPT-5.6 وKimi K3. وتقوم الشركة بالفعل بإعادة توجيه الطلبات من V4-Pro إلى النموذج الجديد، مع تطبيق التسعير المحدث اعتبارًا من 14 سبتمبر.
أوزان مفتوحة، استراتيجية مفتوحة
أطلق DeepSeek أوزان النموذج تحت ترخيص MIT على Hugging Face. يمكن الوصول إلى النموذج الجديد عبر واجهة برمجة تطبيقات DeepSeek عبر نقطة النهاية "deepseek-flash". إن مزيج الأوزان المفتوحة ووصول واجهة برمجة التطبيقات يخلق مسارين للتبني: المطورون الذين يرغبون في تشغيل الاستنتاج على بنية تحتية خاصة بهم يمكنهم تنزيل النموذج ونشره محليًا، بينما يمكن للذين يفضلون الخدمات المدارة استدعاء واجهة برمجة التطبيقات وفقًا لمستويات التسعير الجديدة لـ DeepSeek.
الآثار المتعلقة بالعرض العام الأول والموقع التنافسي
توقيت إطلاق V4.1-Flash ليس عشوائيًا. من المتوقع أن تطرح DeepSeek للتداول في سوق STAR في شنغهاي، وإظهار استمرار الزخم التقني هو النوع من الأمور التي تجعل عروض جولات الاستثمار أكثر إقناعًا.
الفهم متعدد الوسائط المدمج في V4.1-Flash، الذي يغطي بيانات المرئيات والنص، يقلص الفرص التمييزية المتاحة للمنافسين، بما في ذلك OpenAI وMoonshot AI، التي تطور Kimi K3.
