إطلاق DeepSeek V4.1 Flash بأوزان مفتوحة: بنية 552B وأسعار API ودليل الترحيل
أُطلق DeepSeek V4.1 Flash في 10 سبتمبر 2026 وأصبحت أوزان النموذج متاحة؛ واسم الاستدعاء الرسمي في API هو deepseek-flash. يدعم النموذج إدخال النصوص والصور بصورة أصلية، ويستخدم بنية غير متماثلة جديدة: يبلغ حجم الـ backbone 552B من المعلمات، ويُفعَّل نحو 8B من المعلمات لكل Token عند معالجة الإدخال، ونحو 16B عند توليد الإخراج. الإعلان الرسمي
ما يهم المطورين هنا ليس ارتفاع نتائج الاختبارات فقط. فهناك ثلاثة أمور تؤثر مباشرة في التكامل: تحسن قدرات الوكلاء، انخفاض سعر التخزين المؤقت في الجلسات الطويلة، وتغير النموذج الفعلي خلف أسماء النماذج القديمة. وقد أعلنت DeepSeek خصوصًا جدول توجيه deepseek-v4-pro بعد 14 سبتمبر 2026 الساعة 12:00 بتوقيت بكين.
تستخدم الصور في المقال صور الإصدار الرسمي من DeepSeek من دون تعديل. أما أرقام الاختبارات فهي نتائج نشرتها الجهة المزودة وليست إعادة اختبار مستقلة من موقعنا.
ما هو DeepSeek V4.1 Flash؟ المواصفات الأساسية
| البند | المعلومات المنشورة |
|---|---|
| تاريخ الإصدار | 10 سبتمبر 2026 |
| اسم نموذج API الرسمي | deepseek-flash |
| نوع النموذج | MoE متعدد الوسائط أصلي، يستقبل النصوص والصور ويولد النص |
| حجم الـ backbone | 552B، أي نحو 552 مليار معلمة |
| المعلمات المفعلة للإدخال / الإخراج | 8B / 16B (prefill / decode) |
| البنية الأساسية | Causal Encoder-Decoder، وتختصر إلى CED |
| نافذة السياق | 1M Tokens |
| الحد الأقصى لإخراج API | 384K Tokens |
| Global KV Cache | 890 bytes / Token، أي نحو ربع V4 Flash |
| ترخيص الأوزان والمستودع | MIT |
ارجع إلى بطاقة النموذج الرسمية من DeepSeek للمواصفات والبنية، وإلى صفحة أسعار API الرسمية للسياق وحدود الإخراج وخصائص الواجهة. تقرّب بعض الملخصات الرقم إلى 550B، لكن هذا المقال يستخدم الرقم الرسمي 552B.
إذا كنت تخطط للاتصال عبر موقعنا، فابدأ بمراجعة أسعار النماذج الفورية. فالإعلان الرسمي ومزامنة بوابة خارجية أمران مختلفان: اضبط معرّف النموذج الفعلي من الدليل، واعتمد على الدليل الحالي ونتائج الاستدعاء والفواتير الفعلية لمعرفة السعر والتوافر على موقعنا.
ماذا تعني 552B و8B و16B؟
لا تستخدم نماذج MoE جميع المعلمات مع كل Token. يشير 552B إلى حجم معلمات الـ backbone، بينما يشير 8B و16B إلى حجم المعلمات المفعلة لكل Token في مرحلتي الحساب المعنيتين. ولا ينبغي اعتبارها ثلاثة «أحجام نموذج» قابلة للاستبدال.
يتكون backbone من نوع CED في V4.1 Flash من 40 طبقة: 20 طبقة causal encoder و20 طبقة decoder. وتوضح بطاقة النموذج أن Global KV Cache الخاص بالـ decoder يُستخرج بإسقاط الحالة المخفية النهائية للـ encoder، وليس بتوليده بصورة مستقلة في كل طبقة decoder. وهذا يسمح لمعالجة الإدخال وتوليد الإخراج باستخدام مقياسين مختلفين للحساب.
بالنسبة إلى تحليل مستودعات الكود وقراءة المواد الطويلة واستدعاء الأدوات عبر جولات متعددة، تساعد هذه البنية على تقليل عبء معالجة الإدخال. لكنها لا تعني أن جودة الإدخال والإخراج يمكن الحكم عليها بعدد المعلمات المفعلة فقط، ولا تعني أن التنزيل أو النشر يحتاج إلى أوزان من مستوى 8B فقط.
أين تحسنت نتائج الوكلاء؟ مقارنة مع V4 Pro
الجدول التالي مقتبس من جدول المقارنة في بطاقة النموذج الرسمية. عمود التغير يمثل فرق النقاط وليس النسبة المئوية النسبية.
| الاختبار | V4 Pro | V4.1 Flash | التغير |
|---|---|---|---|
| DeepSWE v1.1 | 62.7 | 74.2 | +11.5 |
| Terminal-Bench 3.0 | 11.8 | 30.0 | +18.2 |
| AutomationBench | 43.2 | 54.8 | +11.6 |
| CyberGym | 83.3 | 88.1 | +4.8 |
| GPQA Diamond | 92.4 | 90.9 | −1.5 |
توضح الاختبارات الأربعة الأولى أن V4.1 Flash يتفوق على Pro السابق في عدة اختبارات للبرمجة والطرفية والأتمتة، لكن GPQA Diamond ما زال أقل من V4 Pro. لذلك فالصياغة الأدق هي أن قدرات الوكلاء تحسنت بوضوح، لا أن النموذج يتفوق في كل قدرة. جدول الاختبارات وشروطها الرسمية
وتهم بيئة التشغيل أيضًا. فقد استخدمت مقارنة Instruct في بطاقة النموذج أعلى شدة استدلال، مع temperature=1.0 وtop_p=0.95؛ وترتبط نتيجة 74.2 في DeepSWE v1.1 ببيئة mini-SWE، بينما حقق النموذج نفسه 72.6 في DSH Minimal. وتؤثر نسخة النموذج ومجموعة المهام وإطار Agent وميزانية الاستدلال معًا في النتيجة.
عند الاختيار، استخرج ثلاث عينات من مهامك: إصلاح كود له اختبار قائم، ومهمة طرفية تحتاج إلى أوامر متعددة، ومادة تتضمن لقطة شاشة أو مخططًا. قارن معدل الإنجاز والوقت الإجمالي والفاتورة؛ فهذا أقرب إلى الفائدة الفعلية من مقارنة نتيجة واحدة في لوحة ترتيب.
أسعار API: يوان واحد للإدخال وأربعة يوانات للإخراج لكل مليون Token خارج الذروة
بدأت هذه الأسعار في 10 سبتمبر 2026 الساعة 12:00 بتوقيت بكين. والأسعار أدناه هي أسعار DeepSeek الرسمية للاتصال المباشر بالـ RMB، بوحدة يوان / مليون Tokens، وليست أسعار بوابة موقعنا. صفحة الأسعار الرسمية
| بند الفوترة | خارج الذروة | وقت الذروة |
|---|---|---|
| الإدخال: cache hit | ¥0.02 | ¥0.04 |
| الإدخال: cache miss | ¥1.00 | ¥2.00 |
| الإخراج | ¥4.00 | ¥8.00 |
وقت الذروة هو من الاثنين إلى الجمعة، 09:00—12:00 و14:00—18:00 بتوقيت بكين؛ أما بقية الأوقات، بما في ذلك عطلة نهاية الأسبوع، فهي خارج الذروة. استخدم هذا الإطار المحدد، ولا تطبق من تلقاء نفسك جدول أيام العمل المعدل للعطلات.

المصدر: إصدار DeepSeek الرسمي، مع إبقاء الصورة الأصلية دون تعديل. قد تتغير الأسعار، ويحاسب مزودو الخدمات الخارجية بصورة مستقلة.
مثال على فاتورة Agent يمكن إعادة حسابها
افترض أن مجموعة مهام استخدمت 8 ملايين Token من الإدخال مع cache hit، ومليوني Token من الإدخال مع cache miss، و0.5 مليون Token من الإخراج، وجميعها ضمن الفترة نفسها:
إجمالي التكلفة = ملايين إدخال hit × سعر hit
+ ملايين إدخال miss × سعر miss
+ ملايين الإخراج × سعر الإخراج
خارج الذروة: 8 × 0.02 + 2 × 1 + 0.5 × 4 = 4.16 يوان
وقت الذروة: 8 × 0.04 + 2 × 2 + 0.5 × 8 = 8.32 يوان
صحيح أن سعري الإدخال يختلفان 50 مرة، لكن هذا لا يعني أن المهمة كلها تصبح أرخص 50 مرة. ففي المثال لا يكلف جزء الإدخال ذي cache hit سوى 0.16 يوان، بينما يكلف الإدخال غير الموجود في cache والإخراج 2 يوان لكل منهما. لذلك يجب أن تراعي عملية التحسين التخزين المؤقت واستدعاءات الأدوات المتكررة والإخراج الزائد وإعادة المحاولة.
لماذا يهم تصغير KV Cache في الجلسات الطويلة؟
يخزن KV Cache نتائج الحساب الوسيطة للسياق. وبالنسبة إلى الوكلاء الذين يقرؤون مستودع الكود وتعليمات النظام وسجل المحادثة نفسه مرارًا، فإن إعادة استخدام البادئة نفسها تقلل الحسابات المكررة. وقد ضغط V4.1 Flash قيمة Global KV Cache إلى 890 bytes / Token، أي نحو ربع V4 Flash. شرح البنية الرسمي

المصدر: إصدار DeepSeek الرسمي، مع إبقاء الصورة الأصلية دون تعديل. يقارن الرسم Global KV Cache لكل Token، وليس إجمالي VRAM اللازمة لنشر النموذج.
يجب التمييز بين مقياسين للتخزين: تذكر المواد الرسمية أن احتياج HBM الخاص بالـ cache ينخفض إلى نحو 1/4، واحتياج SSD إلى نحو 1/8. وهذا يصف موارد التخزين المؤقت، وليس أوزان النموذج كلها أو الذاكرة التشغيلية أو عنقود النشر بالكامل.
بالنسبة إلى جهة التكامل، حافظ على ثبات البادئة القابلة لإعادة الاستخدام، وتجنب إضافة طوابع زمنية متغيرة أو معرفات عشوائية أو قائمة أدوات يعاد ترتيبها في كل جولة. ثم افحص معدل الإصابة الفعلي عبر حقول usage؛ ولا تفترض حدوث cache hit لمجرد أن «المحتوى متشابه».
كيف تستدعي DeepSeek V4.1 Flash API؟
استخدم الاسم الرسمي deepseek-flash في التكاملات الجديدة. المثال التالي يستدعي Chat Completions API المباشر؛ اضبط DEEPSEEK_API_KEY في الطرفية أولًا. لم يخضع المثال لاستدعاء مدفوع عبر موقعنا.
curl https://api.deepseek.com/chat/completions \
-H "Authorization: Bearer ${DEEPSEEK_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-flash",
"messages": [
{
"role": "user",
"content": "اذكر خطوات التنفيذ والحالات الحدية وطريقة القبول لأداة إعادة تسمية ملفات Markdown على دفعات."
}
],
"thinking": {"type": "enabled"},
"reasoning_effort": "high",
"max_tokens": 2048,
"stream": false
}'
من المتوقع أن يكون نص الإجابة في choices[0].message.content. عند التحقق، افحص حالة HTTP ومحتوى الاستجابة وusage؛ فلا يكفي التأكد من إرسال الطلب. دليل الاستدعاء الأول الرسمي
تعني الرؤية الأصلية أن النموذج يفهم الصور، لا أنه يولدها. وعند معالجة لقطات الشاشة، أضف كتل محتوى الصور وفق دليل فهم الصور الرسمي. ولا يغني نجاح طلب نصي عن اختبار إدخال الصور واستدعاء الأدوات والبث كل على حدة.
إذا استخدمت بوابة خارجية، فتحقق معًا من Base URL ومعرف النموذج وطريقة المصادقة ودعم البروتوكول. فتغيير العنوان الرسمي وحده لا يضمن تطابق القدرات أو الفوترة.
هل ما زالت النماذج القديمة تعمل؟ متى ينتقل V4 Pro؟
| اسم النموذج المكوّن حاليًا | المعالجة الرسمية |
|---|---|
deepseek-flash |
الاسم الموصى به للتكامل الجديد ويستدعي V4.1 Flash |
deepseek-v4-flash |
أُلغي النموذج القديم، والاسم متوافق مؤقتًا ويوجّه إلى V4.1 Flash |
deepseek-v4-flash-vision-exp |
أُلغي النموذج القديم، والاسم متوافق مؤقتًا ويوجّه إلى V4.1 Flash |
deepseek-v4-pro |
بعد 14/09/2026 الساعة 12:00 بتوقيت بكين وقبل إطلاق V4.1 Pro، يوجّه بالكامل إلى V4.1 Flash ويحاسب بأسعار Flash الجديدة |
هذه هي خطة DeepSeek الرسمية للواجهة؛ وقد تستخدم البوابات الخارجية أسماء مستعارة أو جداول ترحيل مختلفة. الاحتفاظ بالاسم القديم لا يثبت استخدام النموذج القديم، ولا يصلح كخطة للعودة إلى الأوزان القديمة.
يمكن تنفيذ الترحيل في ثلاث خطوات: صدّر أسماء النماذج الحالية وعينات الطلبات المهمة؛ اختبر النصوص والصور والأدوات واستخدام cache بالاسم الجديد؛ ثم حدّث النموذج الافتراضي وقوالب المهام وسجلات الفوترة. وللمهام التي تتطلب قابلية إعادة إنتاج صارمة، سجّل تاريخ الاستدعاء والمزود الفعلي والاستجابة، لا الاسم القديم فقط.
ما الجديد في DeepSeek Harness v0.1.5؟
يتولى النموذج الفهم والاستدلال، بينما يربط Harness الملفات والأوامر والأدوات ليحول مخرجات النموذج إلى مهمة قابلة للتنفيذ. ومع إصدار النموذج، حدثت DeepSeek Harness إلى v0.1.5، مع تكييفها مع standard mode وProgrammatic Tool Calling (PTC) وminimal mode.
بحسب مواد الإصدار، تدعم النسخة الجديدة رفع الصور وPDF، وشجرة ملفات مساحة العمل ومعاينة المخرجات، وتحسن استعادة الجلسات الطويلة والتنقل، وتعزز الاتصال ثنائي الاتجاه بين parent/child Agent والرسائل في قائمة الانتظار والتدخل في المهام. ويمكن لـ Agent Teams التجريبية تقسيم العمل عبر قائمة مهام مشتركة، لكنها معطلة افتراضيًا وتستهلك Tokens إضافية عند تفعيلها.
إذا كان Node.js مثبتًا، فابدأ حسب المستودع الرسمي:
npx @deepseek-ai/dsh web
بعد التشغيل، املأ مفتاح DeepSeek API في واجهة الويب، واختر مساحة العمل ثم أرسل المهمة. يجلب هذا الأمر إصدار الحزمة المتاح وقت التنفيذ ولا يثبت v0.1.5؛ ولإعادة إنتاج بيئة تاريخية، سجّل الإصدار الفعلي بصورة منفصلة.
ابدأ بمهمة صغيرة قابلة للقبول:
Read the current workspace project notes and create a Markdown getting-started guide.
Include startup commands, required configuration, and one minimal validation step.
Only add docs/getting-started-draft.md; do not change business code.
After completion, check whether the paths in the document exist and list anything that could not be confirmed.
النتيجة المتوقعة ملف Markdown حقيقي قابل للفتح، لا مجرد رسالة «تم الإنجاز» في الدردشة. تحقق من إنشاء الملف وصحة المسارات ومصدر أوامر التشغيل، ثم وسّع المهام تدريجيًا. راجع دروس التكامل لمزيد من إعدادات العميل.
هل يمكن نشر النموذج المفتوح المصدر على حاسوب عادي؟
لا يمكن استنتاج أن تفعيل 8B فقط في الإدخال يعني أن أجهزة من مستوى 8B تكفي للنشر. فما زال حجم backbone في V4.1 Flash هو 552B، ويعتمد النشر الفعلي على دقة الأوزان وملاءمة runtime وcache والتزامن والتخزين.
يستخدم النموذج والأوزان ترخيص MIT؛ راجع مستودع النموذج الرسمي والتقرير التقني. ويذكر الإصدار تعاونًا في النشر واسع النطاق لفرق لديها نحو 2000 GPU وعنقود تخزين؛ وهذا شرط للتعاون، وليس أقل مواصفات نشر معلنة.
إذا كان الهدف الأساسي هو بناء التطبيقات أو تشغيل الوكلاء أو قياس أثر الأعمال، فمن الأفضل عادة جمع بيانات الجودة والتكلفة من خلال API أولًا ثم تقييم الاستضافة الذاتية.
الأسئلة الشائعة
هل DeepSeek V4.1 Flash هو 550B أم 552B؟
تستخدم صفحة الإصدار وبطاقة النموذج الرسميتان 552B لحجم الـ backbone. أما 550B فهو تقريب في بعض الملخصات؛ استخدم 552B في جداول المواصفات وتقييم النشر.
ما هو API model ID الخاص بـ V4.1 Flash؟
توصي DeepSeek رسميًا باستخدام deepseek-flash. لا تخترع الاسم deepseek-v4.1-flash اعتمادًا على الاسم الظاهر؛ فحتى إن استخدمته منصة خارجية، فهذا لا يجعله اسم الواجهة الرسمي.
هل يشتري 0.02 يوان مليون Token عشوائيًا؟
لا. يخص سعر 0.02 يوان / مليون Tokens إدخال cache hit خارج أوقات الذروة فقط. أما الإدخال غير الموجود في cache والإخراج وأوقات الذروة فلها أسعار مختلفة.
هل يدعم V4.1 Flash فهم الصور وتوليدها؟
يستقبل النصوص والصور بصورة أصلية ويولد النص، ويمكن استخدامه لفهم لقطات الشاشة وتحليل المخططات. ولا تصفه بطاقة النموذج الرسمية بأنه نموذج لتوليد الصور.
هل أُلغي V4 Pro بالكامل؟
حتى تاريخ نشر المقال، 10 سبتمبر 2026، أعلنت DeepSeek جدول التبديل بعد 14 سبتمبر الساعة 12:00 فقط؛ لذلك لا تكتب مسبقًا أنه تبدل بالكامل. أما نموذجا Flash القديمان فقد أُلغيا، مع بقاء الاسمين متوافقين مؤقتًا.
هل يحاسب موقعنا وفق أسعار DeepSeek الرسمية للذروة وخارجها؟
لا ينبغي استنتاج ذلك مباشرة. يشرح جدول الأسعار API المباشر من DeepSeek؛ أما معرّف النموذج والتوافر وفوترة موقعنا فتخضع لـأسعار النماذج الفورية والفواتير الفعلية. بعد تأكيد النموذج، ابدأ باختبار صغير عبر صفحة الشراء.
الخلاصة: احسب تكلفة المهمة كاملة أولًا، ثم راقب نافذة الترحيل
يجمع DeepSeek V4.1 Flash بين الرؤية الأصلية والحساب غير المتماثل وذاكرة سياق مؤقتة أكثر إحكامًا. وبالنسبة إلى الوكلاء ذوي الإدخال الطويل واستدعاءات الأدوات المتعددة، فهذا تحديث يستحق التحقق منه عبر مهام حقيقية. أما التطبيقات الحالية المعتمدة على API، فأهم ما يجب تأكيده هو توجيه الأسماء المستعارة القديمة وموعد انتقال Pro في 14 سبتمبر.
الترتيب العملي هو: تأكيد معرّف النموذج → اختبار مهامك → مطابقة cache وفوترة الإخراج → تحديث الإعدادات. بهذه الطريقة يتحول إطلاق النموذج إلى ترقية تطبيق قابلة للقياس.
المصادر
- صفحة DeepSeek V4.1 Flash الرسمية: تاريخ الإصدار وبنية 552B ووقت تفعيل الأسعار وجدول الترحيل.
- بطاقة النموذج الرسمية: بنية CED وجدول التقييم وبيئة الاختبار وKV Cache وترخيص MIT.
- نماذج وأسعار DeepSeek الرسمية: أسعار RMB في الذروة وخارجها وحدود السياق والإخراج.
- دليل الاستدعاء الأول الرسمي: معرّف النموذج الحالي وأمثلة الطلب والأسماء المتوافقة.
- دليل فهم الصور الرسمي: قدرة إدخال الصور وصيغتها.
- مستودع DeepSeek Harness الرسمي: طريقة التشغيل وحالة معاينة المطورين.
- مواد إضافية: مقال WeChat الأول، مقال WeChat الثاني. يستند قسم Harness v0.1.5 إلى مواد الإصدار المرافقة.
تاريخ التحقق من المواد: 10 سبتمبر 2026. هذا شرح لمعلومات الإصدار ودليل تكامل، وليس اختبار أداء مستقلًا.