DeepSeek V4 Flash 0731: عرض توضيحي للعبة بتكلفة 0.07 دولار، أسعار API، البنية، ومعايير البرمجة
أحدث DeepSeek V4 Flash 0731 مزيجًا غير معتاد من ردود الفعل. أعجب المطورون بدرجات وكيل البرمجة لديه. وتهتم فرق البنية التحتية بمليون رمز...

DeepSeek V4 Flash 0731: كيف أدى نموذج أعيد تدريبه لاحقًا إلى إشعال حرب أسعار عالمية
مقدمة
أحدث نموذج DeepSeek V4 Flash 0731 مزيجًا غير معتاد من ردود الفعل.
المطورون معجبون بدرجاته العالية في تقييمات العملاء البرمجيين.
فرق البنية التحتية مهتمة بنافذة السياق البالغة مليون رمز وانخفاض عدد المعاملات النشطة.
منصات الذكاء الاصطناعي تقدم استخدامًا مجانيًا وخصومات قوية.
ووسائل التواصل الاجتماعي تمتلئ بلقطات شاشة لنماذج أولية يُقال إن فواتير الاستدلال الخاصة بها تُقاس بالسنتات وليس بالدولارات.
من بين الأمثلة الأكثر تداولًا في المقال المصدر:
- نموذج أولي صغير للعبة تصويب فضائية ثلاثية الأبعاد يُقال إنه أُنشئ بتكلفة حوالي 0.07 يوان صيني.
- نموذج أولي على غرار لعبة Counter-Strike يُقال إنه أُنشئ بتكلفة تقريبية 0.50 يوان صيني.
- لوحة تحكم استخدام شخصية تعرض 87 مليون رمز مقابل 31.57 يوان صيني.
- تقرير OpenCode عن معالجة 8 تريليون رمز من DeepSeek Flash في الأول من أغسطس.
- زيادة Cline لحصتها المجانية بعد اكتشاف أن دعم تكلفة النموذج أرخص من المتوقع.
- خصم Nous Portal المؤقت بنسبة 90% على V4 Flash 0731.
هذه الأمثلة تلتقط الحماس، لكنها قد تخلط أيضًا بين عدة أمور مختلفة:
- السعر الرسمي لواجهة برمجة تطبيقات DeepSeek.
- تسعير إصابات ذاكرة التخزين المؤقت مقابل عدم إصابتها.
- الوصول المجاني أو المدعوم من أطراف ثالثة.
- عدد استدعاءات الأدوات التي يقوم بها العميل البرمجي.
- كمية المخرجات والتفكير المخفي المُولَّد.
- تكلفة النموذج وحده مقابل تكلفة المنتج الكامل.
النموذج رخيص بالفعل.
لكن هذا لا يعني أن كل تطبيق سيكلف سبعة سنتات.
السؤال المفيد ليس ما إذا كان يمكن إعادة إنتاج عرض تجريبي معين بدقة. بل هو كيف حققت DeepSeek قفزة قدرات بهذا الحجم دون تغيير البنية الأساسية — وما تعنيه الاقتصاديات الجديدة للمطورين.
دورة الخصم العالمية
كان السعر الرسمي لواجهة البرمجة منخفضًا بالفعل قبل تطبيق العروض الترويجية من أطراف ثالثة.
تدرج DeepSeek حاليًا الأسعار التالية لكل مليون رمز:
| نوع الاستخدام | سعر DeepSeek V4 Flash |
|---|---|
| إدخال، إصابة ذاكرة التخزين المؤقت | 0.0028 دولار |
| إدخال، عدم إصابة ذاكرة التخزين المؤقت | 0.14 دولار |
| إخراج | 0.28 دولار |
تدعم الواجهة:
- نافذة سياق تبلغ مليون رمز.
- ما يصل إلى 384 ألف رمز إخراج.
- وضعي التفكير وعدم التفكير.
- ثلاثة مستويات لجهد التفكير في بطاقة نموذج 0731:
منخفضومرتفعوأقصى. - استدعاءات الأدوات.
- مخرجات JSON.
- إكمال بادئة المحادثة في مرحلة تجريبية.
- إكمال FIM في وضع عدم التفكير.
- Chat Completions متوافقة مع OpenAI.
- واجهة Responses API.
- واجهة متوافقة مع Anthropic.
- حد نشر معلن قدره 2500 طلب متزامن لكل حساب لـ V4 Flash.
هذه الأسعار الرسمية هي خط الأساس.
يمكن للمنصات بعد ذلك أن تختار:
- تمرير السعر كما هو.
- إضافة هامش ربح.
- دعم الاستخدام.
- تقديم نموذج مجاني محدود.
- دمج النموذج في اشتراك.
- تقديم أرصدة ترويجية.
- توجيه حركة المرور عبر مزود استدلال آخر.
لهذا السبب قد يدفع مطور ما سعر DeepSeek الرسمي بينما لا يدفع آخر شيئًا لفترة محدودة.
OpenCode يعلن معالجة ثمانية تريليونات رمز في يوم واحد
صرح OpenCode علنًا أن DeepSeek Flash عالج 8 تريليونات رمز في الأول من أغسطس عبر منصته.
يقسم المنشور الرقم على النحو التالي:
5 تريليونات رمز استخدام مجاني
+
3 تريليونات رمز عبر OpenCode Go

توثيق Zen الحالي لـ OpenCode يدرج خيار DeepSeek V4 Flash Free متاحًا لفترة محدودة.
هذا تمييز مهم.
رقم الـ 8 تريليونات رمز يصف حركة المرور عبر OpenCode، وليس الاستخدام المباشر الذي أبلغت عنه DeepSeek عبر جميع المنصات.
ومع ذلك، فهي إشارة قوية على أن النماذج منخفضة التكلفة يمكنها توليد طلب هائل عند وضعها داخل سير عمل شائع لوكلاء البرمجة.
Nous Portal تخفض السعر مؤقتًا بنسبة 90%
أعلنت Nous Research عن عرض ترويجي لمدة سبعة أيام يقدم DeepSeek V4 Flash 0731 بخصم 90% عبر Nous Portal بالشراكة مع Novita Labs.

قارن المنشور الترويجي التكلفة المخفضة مع Claude Fable 5 وادعى وجود فرق سعر يزيد عن 1000 ضعف في المهام المماثلة.
تعتمد هذه المقارنة على عدة خيارات:
- سعر المزود المستخدم.
- ما إذا كان الإدخال أو الإخراج هو السائد.
- ما إذا كان التخزين المؤقت متاحًا.
- إعداد الاستدلال المُختار.
- عدد الرموز التي يحتاجها كل نموذج لإكمال المهمة.
- المعيار أو سير العمل الذي يحدد "المماثلة".
مقارنة السعر لكل رمز مفيدة، ولكن المقياس الأكثر دلالة هو:
التكلفة الإجمالية لكل مهمة مقبولة
النموذج الذي يستخدم رموزًا أقل تكلفة وبتكلفة أعلى قد يكون أرخص من نموذج منخفض السعر يعيد المحاولة مرارًا.
وبالمقابل، عندما يكون النموذج منخفض السعر قادرًا أيضًا على إكمال المهمة بسرعة، يمكن أن تصبح الميزة التكلفية هائلة.
Cline تضاعف الحصة المجانية ثلاث مرات
أعلنت Cline في البداية عن استخدام مجاني لـ V4 Flash 0731 عبر وكيل البرمجة الخاص بها.
وذكر منشور عام لاحق أن الحصة المجانية تم تضاعفها ثلاث مرات لأن الاقتصاديات بدت مستدامة.

يتضمن كتالوج النماذج الحالي لـ Cline ومواد ClinePass نموذج DeepSeek V4 Flash كخيار سريع وموجه نحو القيمة للمهام البرمجية المركزة.
يمكن أن تتغير الحصص المجانية وتوافر النماذج، لذا يجب على المستخدمين التحقق من صفحة المزود المباشرة بدلاً من الاعتماد على لقطة شاشة قديمة.
الدرس الأوسع أكثر ديمومة.
عندما يصبح الاستدلال رخيصًا بما يكفي، يمكن لمنصة الوكلاء استخدام الوصول المجاني كاكتساب للعملاء دون تحمل
نفس التكلفة التي سيتكبدها مع نموذج حدودي متميز.
لقطات شاشة التكلفة المجتمعية تحتاج إلى سياق
تتضمن المقالة المصدرية لوحة معلومات تعرض:
- إنفاق بقيمة 31.57 يوان صيني.
- 2,282 طلب API.
- 87,027,995 رمزًا.

تُعد لقطة الشاشة مفيدة لأنها توضح حجم التكاليف الذي قد يراه المطورون في ظل أنماط الاستخدام المواتية.
لكنها لا تكشف عن معلومات كافية لإعادة بناء الفاتورة بدقة.
تشمل المتغيرات المفقودة:
- نسبة الرموز المدخلة إلى المخرجة.
- نسبة إصابات الذاكرة المؤقتة (Cache).
- إصدار النموذج المستخدم في كل تاريخ.
- مستوى جهد التفكير.
- عدد استدعاءات الأدوات.
- الطلبات الفاشلة.
- الأرصدة الترويجية.
- خصومات المزود.
- ما إذا كانت جميع الرموز قابلة للفوترة بنفس السعر.
يمكن أن يكون موجه النظام الطويل المتكرر رخيصًا للغاية عندما يصيب الذاكرة المؤقتة.
أما الموجه الفريد الطويل المُرسل مرة واحدة فتُحتسب تكلفته بسعر الإدخال غير المُخزن في الذاكرة المؤقتة.
كما أن الإخراج أغلى بكثير من الإدخال المخزن في الذاكرة المؤقتة.
بالنسبة للأنظمة الوكيلة، تهيمن هذه الاختلافات على الفاتورة النهائية.
فلاش بليتز: ما الذي تغير في 31 يوليو
أُطلق DeepSeek V4 Preview في 24 أبريل 2026.
شملت العائلة:
- DeepSeek V4 Pro.
- DeepSeek V4 Flash.
أسس إصدار Preview البنية الرئيسية:
- خليط متناثر من الخبراء.
- سياق بطول مليون رمز.
- اهتمام فعال بالسياقات الطويلة.
- أعداد معلمات نشطة منخفضة نسبيًا إلى السعة الإجمالية.
- أوضاع التفكير وعدم التفكير.
- أوزان مفتوحة بموجب رخصة MIT.
تموضع V4 Flash Preview كبديل أصغر وأسرع وأرخص لـ V4 Pro.
تحديث 31 يوليو غيّر موقعه التنافسي.
صرّحت DeepSeek أن V4 Flash 0731 يستخدم نفس بنية النموذج وحجمه مثل V4 Flash Preview.
أُنتج التحديث من خلال تشغيل عملية تدريب لاحق جديدة.
بشكل مبسط:
نفس بنية الأساس المُدرّبة مسبقًا
+
تدريب لاحق جديد وتحسين وكيل
=
سلوك وكيل برمجي أقوى بكثير
هذا مهم لأنه يُظهر مقدار القدرة التي يمكن أن تظل كامنة في نموذج مُدرّب مسبقًا.
البنية وعدد المعلمات ليسا المنتج كله.
يحدد التدريب اللاحق مدى فعالية النموذج في:
- استخدام الأدوات.
- تخطيط العمل متعدد الخطوات.
- التعامل مع تغذية راجعة من الطرفية.
- التعافي من الأخطاء.
- كتابة وتحرير الملفات.
- اتباع بروتوكول الوكيل.
- تخصيص جهد التفكير.
- العمل داخل بيئة التشغيل.
البنية الأساسية وتفاصيل نقطة التحقق
يصف بطاقة نموذج V4 Flash الأصلي النموذج الأساسي على النحو التالي:
| المواصفات | DeepSeek V4 Flash |
|---|---|
| إجمالي معلمات MoE الأساسية | 284 مليار |
| المعلمات المُفعّلة | 13 مليار |
| طول السياق | 1 مليون |
| الرخصة | MIT |
| الوسيط الرئيسي | نص |
| الدقة الأساسية | FP8 / دقة منخفضة مختلطة حسب نقطة التحقق |
يقول بطاقة نموذج 0731 إن الإصدار الجديد له نفس هيكل متغير DSpark ويتضمن وحدة فك تخميني مرفقة.
وهذا يفسر سبب ظهور بعض بيانات وصف ملفات النموذج قد تظهر
إجمالي عدد نقاط التحقق أكبر من رقم 284 مليار الخاص بنموذج MoE الأساسي.
الوصف الأدق هو:
نموذج MoE الأساسي لـ V4 Flash يظل بحجم إجمالي يبلغ حوالي 284 مليار مع 13 مليار معامل نشط، بينما يتضمن إصدار 0731 مكوّن DSpark الإضافي للفك التنبؤي في نقطة التحقق المنشورة.
فك الترميز التنبؤي DSpark
يستخدم فك الترميز التنبؤي عملية مسودة سريعة لاقتراح عدة رموز مستقبلية.
ثم يتحقق النموذج الرئيسي من تلك الاقتراحات.
عند قبول التوقعات، يمكن للنظام إنتاج رموز متعددة بعمل تسلسلي أقل.
توفر بطاقة نموذج DeepSeek لإصدار 0731 دعمًا صريحًا لـ DSpark لكل من vLLM وSGLang.
بالنسبة لـ vLLM، الإعداد ذو الصلة هو:
--speculative-config '{"method":"dspark","num_speculative_tokens":7,"draft_sample_method":"greedy"}'
بالنسبة لـ SGLang، تستخدم بطاقة النموذج:
--speculative-algorithm DSPARK
لا يحسّن DSpark قدرة النموذج على الاستدلال بحد ذاته.
إنه تحسين للاستدلال يهدف إلى تقليل زمن الاستجابة في فك الترميز أو زيادة الإنتاجية مع الحفاظ على توزيع مخرجات النموذج المستهدف ضمن الإعداد المدعوم.
القفزة في المعايير
تنشر DeepSeek المقارنة التالية لـ V4 Flash 0731:
| المعيار | V4 Flash 0731 | V4 Flash Preview | V4 Pro Preview |
|---|---|---|---|
| Terminal Bench 2.1 | 82.7 | 61.8 | 72.1 |
| NL2Repo | 54.2 | 39.4 | 38.5 |
| CyberGym | 76.7 | 38.7 | 52.7 |
| DeepSWE | 54.4 | 7.3 | 12.8 |
| Toolathlon-Verified | 70.3 | 49.7 | 55.9 |
| Agents’ Last Exam | 25.2 | 15.8 | 16.5 |
| AutomationBench Public | 25.1 | 10.8 | 12.8 |
| DSBench-FullStack | 68.7 | 37.0 | 41.8 |
| DSBench-Hard | 59.6 | 25.8 | 31.1 |
أكثر زيادة دراماتيكية هي في DeepSWE:
7.3 ← 54.4
يقترب CyberGym من المضاعفة:
38.7 ← 76.7
يرتفع Terminal Bench 2.1 بأكثر من عشرين نقطة:
61.8 ← 82.7
يتفوق نموذج Flash الجديد أيضًا على V4 Pro Preview في كل معيار ضمن الجدول المنشور من DeepSeek.
هذا تغيير كبير لنموذج كان موضّعًا في الأساس كخيار أرخص وأسرع.
منهجية المعايير مهمة
لا ينبغي قراءة الجدول كمجرد مقارنة خالصة لنقاط التحقق الخام.
تتضمن بطاقة نموذج DeepSeek عدة ملاحظات مهمة.
بالنسبة لمهام وكيل الكود العامة، استخدمت الشركة:
وضع DeepSeek Harness الأدنى
جهد الاستدلال: أقصى
درجة الحرارة: 1.0
Top-p: 0.95
لم يكن DeepSeek Harness متاحًا للجمهور وقت التحقق.
هذا يعني أن الباحثين الخارجيين قد لا يتمكنون بعد من إعادة إنتاج البيئة البرمجية الدقيقة المستخدمة لنتائج وكيل الكود المنشورة.
كما أن اختبارين داخليان:
- DSBench-FullStack.
- DSBench-Hard.
يمكن أن تكون المعايير الداخلية مفيدة لتطوير المنتج، لكن الفرق المستقلة لا يمكنها فحص المهام المخفية أو ضوابط التلوث.
التفسير الصحيح هو:
تبلغ DeepSeek عن تحسن كبير ضمن حزمة الوكلاء وإعدادات التقييم التي اختارتها. ستتحسن قابلية إعادة الإنتاج العامة عندما يتوفر الإطار والمطالبات والسجلات وإعداد التقييم الكامل.
جودة الإطار يمكن أن تغيّر النتيجة
غالبًا ما يقيس معيار البرمجة نظامًا كاملاً:
النموذج
+
مطالبة النظام
+
أدوات المستودع
+
الطرفية
التنفيذ
+
إدارة السياق
+
سياسة إعادة المحاولة
+
تغذية راجعة من الاختبارات
+
منطق تقديم التصحيحات
يمكن أن يحصل النموذج نفسه على نتائج مختلفة عند تغيّر أحد المكونات.
قد يؤدي الإطار الأفضل إلى:
- اختيار ملفات أكثر صلة.
- الحفاظ على مخرجات الطرفية المفيدة.
- منع تجاوز السياق.
- إعادة محاولة الأوامر الفاشلة بذكاء.
- إيقاف الحلقات غير المنتجة.
- تطبيق التصحيحات بشكل أكثر موثوقية.
- تزويد النموذج بنتائج اختبار أوضح.
هذا لا يجعل النموذج غير ذي صلة.
بل يعني أن نتيجة المعيار تعود إلى مزيج النموذج والإطار.
الأرقام القوية لنسخة 0731 تشير إلى أن DeepSeek حسّن من سلوك النموذج الوكيل وعملية التقييم المحيطة به على حد سواء.
Artificial Analysis تمنحه درجة 50
تشير Artificial Analysis إلى أن مؤشر الذكاء يبلغ حوالي 50 لـ DeepSeek V4 Flash 0731، أي أعلى بعشر نقاط تقريبًا من النسخة السابقة من Flash.
كما تصف شركة تحليل النماذج المستقلة V4 Flash بأنها غير مكلفة استثنائيًا مقارنة بالأنظمة الرائدة الأخرى المعروفة.
لخّصت رويترز نتائج Artificial Analysis بالإشارة إلى أن متوسط تكلفة اختبار المعيار يبلغ حوالي ثلاثة سنتات أمريكية وفق منهجيتها.
هذه المقارنة تدعم حجة القيمة.
لكنها لا تعني أن كل مهمة إنتاجية تكلف ثلاثة سنتات.
كما تذكر Artificial Analysis نتائج أضعف في بعض مقاييس موثوقية المعرفة.
ملاحظاتها حول V4 Flash 0731 تشير إلى:
- دقة المعرفة الشاملة بقيت عند حوالي 37%.
- انخفض معدل الهلوسة لكنه بقي مرتفعًا عند حوالي 84% وفق ذلك التقييم.
هذه الأرقام تذكير مفيد.
يمكن أن يكون النموذج:
- قويًا جدًا في مهام البرمجة الوكيلة.
- رخيصًا للغاية.
- منافسًا في المؤشر المركب.
- لكنه لا يزال غير موثوق في بعض الأسئلة الواقعية مفتوحة المجال.
"أفضل قيمة" ليست مثل "الأفضل لكل مهمة."
أسعار واجهة البرمجة الرسمية
سعر واجهة DeepSeek المباشرة هو:
| فئة الفوترة | السعر لكل مليون رمز |
|---|---|
| إدخال مع ضربة كاش | $0.0028 |
| إدخال بدون ضربة كاش | $0.14 |
| إخراج | $0.28 |
الفجوة السعرية بين ضربة الكاش وعدمها هائلة:
$0.14 ÷ $0.0028 = 50
الإدخال المخزّن في الكاش أرخص بخمسين مرة من الإدخال غير المخزّن.
بالنسبة للوكلاء طويلي التشغيل، يصبح هيكل المطالبة هندسة تكلفة.
مثال على حساب التكلفة
لنفترض أن طلبًا واحدًا يستخدم:
100,000 رمز إدخال بدون كاش
20,000 رمز إخراج
تكلفة النموذج المباشرة هي:
الإدخال:
100,000 / 1,000,000 × $0.14
= $0.014
الإخراج:
20,000 / 1,000,000 × $0.28
= $0.0056
الإجمالي:
$0.0196
هذا أقل من سنتين أمريكيتين.
الآن لنفترض أن نفس البادئة المكونة من 100,000 رمز مخزّنة في الكاش:
إدخال مخزّن:
100,000 / 1,000,000 × $0.0028
= $0.00028
الإخراج:
20,000 / 1,000,000 × $0.28
= $0.0056
الإجمالي:
$0.00588
الآن يهيمن الإخراج على الفاتورة.
هذه الأمثلة تفسر سبب معقولية النماذج الأولية البرمجية منخفضة التكلفة.
لكنها لا تشمل:
- هوامش ربح المزود.
- رسوم واجهات الأدوات.
- تكاليف المتصفح أو البحث.
- الحوسبة المعزولة.
- التخزين.
- المحاولات الفاشلة المتكررة.
- وقت التطوير البشري.
لماذا لا تزال فواتير الوكلاء ترتفع
البرمجة الوكيلة نادرًا ما تكون طلبًا واحدًا.
قد يتضمن سير عمل نموذجي:
- قراءة المستودع.
- البحث عن الكود ذي الصلة.
- تخطيط التغيير.
- تعديل عدة ملفات.
- تشغيل الاختبارات.
- فحص ال
فشل.
7. عدّل مرة أخرى.
8. شغّل الاختبارات مرة أخرى.
9. راجع الفرق.
10. قدّم الإجابة النهائية.
كل خطوة قد تستدعي استدعاء نموذج جديد.
مهمة تبدو صغيرة قد تصبح مكلفة عندما:
- يتم إعادة تحميل سياق المستودع بشكل متكرر دون تخزين مؤقت.
- ينتج النموذج سلاسل استدلال طويلة.
- تفشل الاختبارات عدة مرات.
- يقرأ الوكيل ملفات كبيرة دون حاجة.
- تكرر عدة وكلاء متوازيون العمل.
- يؤدي ضغط السياق إلى إعادة إرسال معلومات مهمة.
- لا يتوقف النموذج بعد الوصول إلى حل جيد.
V4 Flash يقلل من تكلفة هذه الأخطاء.
لكنه لا يلغيها.
التخزين المؤقت للسياق هو الرافعة الرئيسية للتكلفة
تستخدم DeepSeek تخزينًا مؤقتًا للسياق يعتمد على القرص.
عند إعادة استخدام نفس البادئة، يمكن أن تحصل رموز الإدخال المطابقة على سعر أقل للوصول إلى ذاكرة التخزين المؤقت.
المرشّحات الجيدة لبادئة ثابتة تشمل:
- تعليمات النظام.
- سياسات المستودع.
- تعريفات الأدوات.
- مستندات مرجعية طويلة.
- لقطة مشروع غير متغيرة.
- سياق مؤسسي متكرر.
تصميم مبسط للمطالبة هو:
بادئة ثابتة قابلة لإعادة الاستخدام
+
طلب مستخدم جديد
+
أحدث نتيجة أداة
تصميم أقل توافقًا مع التخزين المؤقت هو:
تعليمات معاد ترتيبها
+
ملخص مستودع مُعاد كتابته
+
طوابع زمنية متغيرة
+
بيانات وصفية عشوائية للطلب
+
طلب مستخدم جديد
تغييرات صغيرة في البادئة قد تقلل من إعادة استخدام التخزين المؤقت.
يجب على المطورين فحص حقول استخدام الرموز بدلاً من افتراض أن المطالبة الطويلة قد خُزّنت مؤقتًا.
توفر DeepSeek أيضًا عزل user_id للخصوصية والجدولة. يجب تصميم إعادة استخدام التخزين المؤقت وعزل المستخدم معًا حتى لا يختلط سياق عميل بآخر عن طريق الخطأ.
بدء سريع عبر واجهة API
يظل الرابط الأساسي الرسمي:
https://api.deepseek.com
معرّف النموذج هو:
deepseek-v4-flash
تقول DeepSeek أن معرّف API الثابت يقدم تلقائيًا أحدث إصدار Flash رسمي.
هذا مريح، لكن فرق الإنتاج يجب أن تسجل بصمة النموذج المرتجعة وتختبر التغييرات لأن السلوك خلف معرّف ثابت قد تتم ترقيته.
مثال بايثون
from openai import OpenAI
client = OpenAI(
api_key="YOUR_DEEPSEEK_API_KEY",
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[
{
"role": "user",
"content": "Review this function and propose a safe refactor.",
}
],
)
print(response.choices[0].message.content)
مثال cURL
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DEEPSEEK_API_KEY" \
-d '{
"model": "deepseek-v4-flash",
"messages": [
{
"role": "user",
"content": "Write a small Python CLI that validates JSON files."
}
]
}'
يجب على المطورين مراجعة مرجع API المباشر لمعرفة الحقول الدقيقة لجهد الاستدلال ووضع التفكير المدعومة من نقطة الاتصال وإصدار SDK الخاص بهم.
يجب الحفاظ على سجل التفكير
توثق وثائق وضع التفكير في DeepSeek أنه عندما تتضمن دورة ما استدعاءات أدوات، يجب إعادة تمرير reasoning_content من رسالة المساعد في الطلبات اللاحقة.
يجب على الوكيل متعدد الأدوار الحفاظ على:
content
reasoning_content
tool_calls
قد يؤدي إسقاط حالة التفكير إلى تقليل الاستمرارية أو التسبب في مشكلات في التحقق من الطلبات.
هذا الأمر مهم بشكل خاص عند التكامل عبر عميل متوافق مع OpenAI يتجاهل عادةً حقول التفكير الخاصة بالموفر.
التوافق مع OpenAI وAnthropic وResponses
توفر DeepSeek أكثر من واجهة واحدة.
مكالمات الدردشة بتنسيق OpenAI
استخدم عنوان قاعدة URL القياسي لـ DeepSeek ومعرف النموذج:
deepseek-v4-flash
واجهة برمجة التطبيقات المتوافقة مع Anthropic
توثق DeepSeek أيضًا واجهة بتنسيق Anthropic.
يمكن أن يساعد ذلك البرامج المبنية حول رسائل بأسلوب Claude على الاتصال بـ DeepSeek مع تغييرات أقل في التطبيق.
التوافق لا يضمن سلوكًا متطابقًا.
لا تزال الحقول الخاصة بالموفر، وسجل التفكير، ومخططات الأدوات، والسلوك الأمني، ومعالجة الأخطاء تتطلب اختبارًا.
واجهة برمجة تطبيقات Responses
تقول DeepSeek إن إصدار 0731 يدعم أصليًا تنسيق واجهة برمجة تطبيقات Responses وقد تم تكييفه للاستخدام بأسلوب Codex.
هذا مهم لمنتجات وكلاء البرمجة التي تعتمد بشكل متزايد على كائنات الاستجابة ذات الحالة، واستدعاءات الأدوات، وحلقات الوكلاء المنظمة.
أوزان مفتوحة بموجب ترخيص MIT
أصدرت DeepSeek أوزان V4 Flash 0731 على Hugging Face بموجب ترخيص MIT.
يتيح ذلك للمطورين فحص النموذج ونشره وإعادة توزيعه وتعديله وفقًا لشروط الترخيص.
يوفر إصدار الأوزان المفتوحة تحكمًا أكبر من نموذج API فقط.
يمكن للفرق:
- تشغيل النموذج على بنية تحتية خاصة.
- دراسة بنيته.
- بناء متغيرات كمية.
- تكييف نوى الاستدلال.
- ضبطه بدقة أو تخصيصه.
- دمجه في أنظمة داخلية.
- تجنب إرسال تعليمات برمجية حساسة إلى واجهة برمجة تطبيقات خارجية.
الحاجز العملي هو الأجهزة.
"الأوزان المفتوحة" لا تعني "يعمل على كمبيوتر محمول عادي".
نشر vLLM
توفر بطاقة النموذج الرسمية لإصدار 0731 مثالًا لـ vLLM لعقدة واحدة 4×GB300:
vllm serve deepseek-ai/DeepSeek-V4-Flash-0731 \
--trust-remote-code \
--kv-cache-dtype fp8 \
--block-size 256 \
--data-parallel-size 4 \
--enable-expert-parallel \
--moe-backend deep_gemm_mega_moe \
--attention-config '{"use_fp4_indexer_cache": true}' \
--speculative-config '{"method":"dspark","num_speculative_tokens":7,"draft_sample_method":"greedy"}'
يوضح هذا المثال فئة البنية التحتية المتوقعة للخدمة عالية الجودة الكاملة.
لا ينبغي تفسيره على أنه التكوين المدعوم الوحيد.
قد تضيف وصفة vLLM دعمًا لهياكل GPU أخرى بمرور الوقت.
نشر SGLang
مثال SGLang الرسمي هو:
sglang serve \
--trust-remote-code \
--model-path deepseek-ai/DeepSeek-V4-Flash-0731 \
--tp 4 \
--moe-runner-backend flashinfer_mxfp4 \
--speculative-algorithm DSPARK \
--mem-fraction-static 0.90 \
--chunked-prefill-size 4096 \
--swa-full-tokens-ratio 0.1
تأتي أوزان الهدف والمسودة من نفس نقطة التفتيش، لذلك تقول الوثائق إنه لا ينبغي تعيين مسار منفصل لنموذج مسودة تخميني.
تتطور محركات الاستدلال بسرعة.
استخدم بطاقة النموذج الحالية ووصفة محرك الخدمة بدلاً من نسخ أمر تشغيل قديم من إصدار Preview.
النشر المحلي لا يزال مشروع بنية تحتية
حتى لو كان حوالي فقط
13B معلمة نشطة لكل رمز، ويجب أن تظل أوزان النموذج الكاملة متاحة عبر نظام الخدمة.
يجب أن يأخذ تخطيط النشر في الاعتبار:
- إجمالي تخزين النموذج.
- ذاكرة وحدة معالجة الرسومات.
- التوازي بين الخبراء.
- عرض نطاق الربط البيني.
- ذاكرة التخزين المؤقت للسياق الطويل.
- دعم التكميم.
- نوى DSpark.
- حجم الدفعة.
- التزامن.
- زمن استجابة ما قبل التعبئة.
- إنتاجية فك التشفير.
قد تجعل عمليات التكميم الأصغر التجريب ممكنًا على أجهزة مختلفة، لكنها قد تغير الجودة أو السرعة أو طول السياق المدعوم.
بالنسبة لمعظم المطورين الأفراد، ستكون واجهة برمجة التطبيقات المباشرة أو مزود الاستضافة أسهل وأرخص من الاستضافة الذاتية.
واجهة برمجة التطبيقات الرسمية مقارنة بمزودي الطرف الثالث
هناك ثلاث طرق شائعة لاستخدام V4 Flash.
| المسار | الميزة الرئيسية | المفاضلة الرئيسية |
|---|---|---|
| واجهة برمجة تطبيقات DeepSeek | التسعير الرسمي والنموذج الرسمي الحالي | تغادر البيانات بيئتك؛ قد يتم تحديث المعرّف المستقر |
| منصة الطرف الثالث | حصص مجانية، وكلاء مدمجون، فوترة أسهل | قد تتغير العروض الترويجية والتوجيه |
| الأوزان المستضافة ذاتيًا | أقصى تحكم وخصوصية | متطلبات أجهزة وهندسة كبيرة |
يعتمد المسار الأرخص على عبء العمل.
قد تكون الحصة المجانية من Cline أو OpenCode الأفضل للتجريب.
قد تكون واجهة برمجة التطبيقات المباشرة الأفضل للاستخدام الصغير الحجم القابل للتنبؤ.
قد تصبح الاستضافة الذاتية جذابة فقط عند حجم مرتفع ومستدام بما يكفي أو عندما تسود متطلبات الخصوصية.
أفضل عصر للنماذج الأولية
تقارن المقالة المصدرية الذكاء الاصطناعي غير المكلف بالإنتاج الضخم للسيارات.
التشبيه غير كامل لكنه مفيد.
عندما تصبح التقنية أرخص بشكل كبير، لا يشتري السوق ببساطة نفس الكمية بسعر أقل.
تصبح الاستخدامات الجديدة ممكنة.
يمكن لنماذج الوكلاء منخفضة التكلفة دعم تجارب كانت سترفض سابقًا قبل الاختبار.
تشمل الأمثلة:
- طالب يبني نموذجًا أوليًا برمجيًا أول.
- مؤسس فردي يولد ويختبر عدة أفكار لصفحات هبوط.
- فريق صغير يدير مراجعة الكود على كل طلب سحب.
- مشروع مفتوح المصدر يقدم فرزًا مجانيًا للمشكلات.
- باحث يعالج مجموعة كبيرة من الأكواد أو المستندات.
- شركة تنشئ وكلاء داخليين للعمل المتكرر.
- مطور ألعاب يختبر آليات ومستويات مولدة.
القيمة ليست في أن النموذج يحل محل كل هندسة البرمجيات.
إنها تخفض تكلفة التساؤل:
هل تستحق هذه الفكرة البناء أكثر؟
النموذج الأولي ليس منتجًا
يمكن للتوليد الرخيص إنتاج عرض توضيحي أول مقنع.
لا يزال المنتج الإنتاجي بحاجة إلى:
- تصميم المنتج.
- الأمان.
- الاختبار.
- إمكانية الوصول.
- الأداء.
- المراقبة.
- النشر.
- حماية البيانات.
- المراجعة القانونية.
- الصيانة.
- دعم العملاء.
فاتورة نموذج بقيمة سبعة سنتات لا تعني نشاطًا تجاريًا بقيمة سبعة سنتات.
إنها تعني أن التجربة الحسابية الأولى قد تكون رخيصة بما يكفي لمحاولتها.
ذلك يغير من يمكنه المشاركة وعدد الأفكار التي يمكن اختبارها.
مثال على مساحة عمل مبنية من المجتمع
تتضمن المقالة المصدرية مساحة عمل مستندات خفيفة تُعرض كمثال لما كان المطورون يبنونه باستخدام وكلاء برمجة غير مكلفين.

لا يمكن للقطة شاشة أن تثبت مقدار التطبيق الذي تم إنتاجه بواسطة النموذج، أو مقدار التحرير البشري المطلوب، أو ما إذا كان المنتج آمنًا وقابلاً للصيانة.
إنها تُظهر نوع المشاريع التي تجعل نماذج البرمجة منخفضة التكلفة أسهل في بناء النماذج الأولية.
أين يتألق V4 Flash بشكل أفضل
V4 Flash 0731 جذاب بشكل خاص عندما:
- تكون المهمة كثيفة البرمجة أو الأدوات.
- تكون التكلفة عاملاً مهمًا للغاية.
- يكون السياق الكبير مفيدًا.
- يُتوقع حجم طلبات مرتفع.
- يمكن لسير العمل التحقق من المخرجات.
- إعادة المحاولة من حين لآخر مقبولة.
- يتوفر نموذج احتياطي أكبر للحالات الصعبة.
قد يكون أقل ملاءمة عندما:
- تكون الدقة الواقعية في العالم المفتوح أمرًا بالغ الأهمية.
- تكون الإجابة الأولى المصقولة أكثر أهمية من التكلفة.
- تتطلب المهمة فهم الصور.
- لا تستطيع المؤسسة التحقق من الكود المُولّد.
- يكون مطلوبًا ضمان امتثال مُدار.
- يعتمد سير العمل على سلوك API مستقر وثابت الإصدار.
يمكن لموجّه النماذج دمج Flash مع نظام أقوى أو أكثر تخصصًا.
على سبيل المثال:
تعديلات المستودع الروتينية
← V4 Flash
قرارات الهندسة المعمارية أو الأمن عالية الخطورة
← نموذج أقوى + مراجعة بشرية
النماذج الرخيصة تغيّر بنية الوكلاء
عندما تكون استدعاءات النماذج مكلفة، يحاول المطورون تقليل كل طلب.
عندما تصبح الاستدعاءات رخيصة، يمكن للوكيل أن يتحمل تكلفة:
- طلب مراجعة التصحيح من نموذج آخر.
- تشغيل تمرير تحليل اختبار منفصل.
- توليد عدة حلول مرشحة.
- مقارنة التطبيقات البديلة.
- استخدام نموذج واحد للتخطيط وآخر للتنفيذ.
- إعادة التحقق من عمله قبل التقديم.
يمكن أن يؤدي هذا إلى زيادة الموثوقية.
يمكن أيضًا أن يهدر الرموز (tokens).
الهدف الصحيح ليس الحد الأدنى من استخدام الرموز.
بل هو:
أقل تكلفة إجمالية تصل إلى الجودة المطلوبة
المخاطر الرئيسية خلف قصة السعر
1. الإصدار التجريبي العام قد يتغير
يصف DeepSeek واجهة برمجة تطبيقات Flash الرسمية بأنها إصدار تجريبي عام.
قد تتغير الأسعار والسلوك والحدود وإصدارات النماذج.
يجب على فرق الإنتاج الاحتفاظ باختبارات الانحدار.
2. درجات المعايير تعتمد على منصة DeepSeek
أقوى نتائج الوكلاء البرمجيين تستخدم إعدادًا غير مُطلق للمنصة.
الاستنساخ المستقل الدقيق ليس سهلًا بعد.
3. المدخلات الرخيصة لا تضمن وكيلًا رخيصًا
يمكن أن يهيمن المخرجات وإعادة المحاولات والأدوات والسياق غير المخزّن مؤقتًا على التكلفة النهائية.
4. السياق الطويل ليس مجانيًا
نافذة المليون رمز هي حد سعة، وليست توصية بإرسال مليون رمز في كل طلب.
أحمال التعبئة المسبقة الكبيرة تزيد من زمن الاستجابة والتكلفة.
5. موثوقية العالم المفتوح لا تزال بحاجة إلى عمل
يُظهر التقييم المستقل أن القيمة والقوة البرمجية يمكن أن تتعايشا مع معدل هلوسة مرتفع في الاختبارات الواقعية.
يجب التحقق من الحقائق الحرجة مقابل المصادر.
6. الكود المُولّد يتطلب مراجعة
يمكن للنماذج منخفضة التكلفة توليد كود أكثر مما يمكن لفريق فحصه بأمان.
تظل الاختبارات الآلية والتحليل الثابت وفحص التبعيات والمراجعة البشرية ضرورية.
7. الوصول الترويجي مؤقت
يمكن أن تختفي النماذج المجانية والخصومات من جهات خارجية.
لا تبنِ نموذج عمل دائمًا على دعم مؤقت لمدة سبعة أيام أو لفترة محدودة.
8. معرّفات API المستقرة قد تخفي الترقيات
معرّف النموذج deepseek-v4-flash يشير إلى الإصدار الحالي.
قد يؤدي الترقية خلف هذا المعرّف إلى تغيير المخرجات دون تغيير في الكود البرمجي لتطبيقك.
قائمة التحقق العملية للتحكم في التكاليف
1. تثبيت البادئات القابلة لإعادة الاستخدام
حافظ على ثبات تعليمات النظام وتعريفات الأدوات لتحسين إعادة استخدام التخزين المؤقت.
2. تتبع الرموز المميزة التي تصيب التخزين المؤقت بشكل منفصل
لا تعتمد فقط على إجمالي رموز الإدخال.
3. الحد من المخرجات غير الضرورية
ضع ميزانية مخرجات واقعية للمهمة.
4. استخدام جهد استدلال أقل للأعمال الروتينية
احتفظ بوضع max للمهام التي تستفيد من التفكير الأطول.
5. تحديد عدد خطوات الوكيل
أوقف الحلقات التي لا تحقق تقدمًا.
6. تشغيل تحقق رخيص قبل استدعاء نموذج آخر
استخدم أدوات الفحص اللغوي والاختبارات والمدققات المنطقية والفحوصات الحتمية.
7. توجيه الحالات الصعبة
قم بالتصعيد فقط عندما تفشل المهمة في اختبار أو تتجاوز حد المخاطر.
8. قياس التكلفة لكل نتيجة مقبولة
ضمّن المحاولات الفاشلة والمراجعة البشرية.
أمر إضافي: DeepSeek Harness
ينتهي المقال المصدر بخطوة تالية محتملة في النظام البيئي للمطورين لدى DeepSeek.
نشر Tianyi Cui، المحدد في المصدر كشخص مسؤول عن DeepSeek Harness، رسالة توظيف لمطوري مشاريع أدوات الوكلاء مفتوحة المصدر.
ودعت الرسالة المطورين المهتمين إلى مشاركة حساب GitHub وأعمالهم البارزة مفتوحة المصدر للمشاركة في الاختبار الداخلي.

كما يشير سجل التغييرات الخاص بـ DeepSeek في 31 يوليو إلى أن الوضع الأدنى من DeepSeek Harness المستخدم لتقييم المعايير "سيُطلق قريبًا".
حتى وقت التحقق، لم أعثر على:
- مستودع رسمي عام لـ DeepSeek Harness.
- صفحة منتج مستقرة لـ "DeepSeek Code".
- تعليمات تثبيت عامة.
- أسعار.
- تاريخ إطلاق.
- مواصفات ميزات كاملة.
تدعم الأدلة هذا الاستنتاج الأضيق:
تختبر DeepSeek أداة وكيل وتعتزم إصدار جزء على الأقل من الإطار، لكن اسم المنتج النهائي والنطاق العام وتوقيت الإطلاق لا تزال غير مؤكدة.
النموذج وAPI والأوزان المفتوحة متاحة الآن.
أداة الوكيل لا تزال مكونًا مستقبليًا في النظام البيئي.
لماذا قد تكون DeepSeek Harness مهمة
يمكن لأداة وكيل من الطرف الأول أن تساعد DeepSeek على التحكم في كامل مجموعة وكيل البرمجة.
يمكن أن توفر:
- معالجة أصلية لتاريخ الاستدلال.
- تنسيقات مطالبات خاصة بالنموذج.
- تحليل استدعاءات الأدوات.
- إدارة السياق.
- البحث في المستودع.
- تنفيذ الأوامر الطرفية.
- قابلية إعادة إنتاج المعايير.
- تكامل مع واجهة برمجة الاستجابات.
- سير عمل متوافق مع Codex.
- ضوابط التكلفة.
- توجيه تلقائي بين Flash وPro.
توثق DeepSeek بالفعل عمليات التكامل مع أدوات الوكلاء الخارجية ووكلاء البرمجة.
أداة تابعة لطرف أول يمكنها تحويل التحسينات المخصصة لمعايير محددة إلى منتج يمكن للمطورين العاديين استخدامه.
كما يمكنها أن تكشف عن مقدار قفزة أداء V4 Flash 0731 في المعايير الذي يأتي من نقطة التفتيش، والمقدار الذي يأتي من بيئة تشغيل الوكيل.
ما الذي يجب متابعته بعد ذلك
ستحدد عدة تطورات ما إذا كانت لحظة V4 Flash ستتحول إلى تحول دائم في النظام البيئي.
الإصدار الرسمي لـ V4 Pro
تقول DeepSeek إن الإصدار الرسمي لـ V4 Pro سيلي تحديث Flash.
ستؤثر الفجوة في الأداء والتسعير بين Pro و Flash على قرارات التوجيه.
توفر DeepSeek Harness
الإصدار العام من شأنه تحسين قابلية استنساخ المعايير ومنح المطورين إطار عمل وكيل أصلي للنموذج.
استقرار الأسعار
السعر المباشر منخفض بالفعل، لكن العروض الترويجية من أطراف ثالثة قد لا تستمر.
قدرة المزود
الاستدلال الرخيص يجذب حركة مرور عالية جدًا.
زمن الاستجابة، حدود المعدل، والموثوقية ستكون مهمة مع توسع الاستخدام.
دعم الاستدلال مفتوح المصدر
vLLM، SGLang، موردو الأجهزة، ومشاريع التكميم سيحددون مدى سهولة الاستضافة الذاتية.
التقييمات المستقلة
يجب أن تختبر المزيد من التقييمات العامة:
- البرمجة.
- الأمان.
- الموثوقية الواقعية.
- السياق الطويل.
- استخدام الأدوات.
- التكلفة لكل مهمة ناجحة.
- الأداء تحت بيئات تشغيل مختلفة.
الأسئلة الشائعة
ما هو DeepSeek V4 Flash 0731؟
DeepSeek V4 Flash 0731 هو الإصدار الرسمي بتاريخ 31 يوليو من V4 Flash، ويُقدَّم حاليًا عبر واجهة برمجة التطبيقات deepseek-v4-flash في نسخة تجريبية عامة. تقول DeepSeek إنه يحافظ على البنية الأساسية وحجم نموذج Preview مع تحسين قدرات الوكيل بشكل كبير من خلال التدريب اللاحق الجديد.
كم تبلغ تكلفة DeepSeek V4 Flash؟
تسرد واجهة برمجة التطبيقات الرسمية لـ DeepSeek 0.14 دولارًا لكل مليون رمز إدخال بدون تخزين مؤقت، و0.0028 دولارًا لكل مليون رمز إدخال مع تخزين مؤقت، و0.28 دولارًا لكل مليون رمز إخراج. قد تقدم منصات الطرف الثالث أسعارًا مختلفة أو حصصًا مجانية أو خصومات مؤقتة.
هل تبلغ تكلفة إنشاء لعبة ثلاثية الأبعاد حقًا 0.07 يوان فقط؟
المقال المصدر يستشهد بمثال من المجتمع بتكلفة النموذج المذكورة. المثال لا يتضمن مطالبات كاملة أو سجلات رموز أو بيانات تخزين مؤقت أو عمليات إعادة محاولة أو تكاليف أدوات أو سجلات عمل بشري، لذا يجب التعامل معه كمعلومة غير مؤكدة وليس كميزانية مضمونة.
ما هي النتائج الرئيسية لمعايير V4 Flash 0731؟
أفادت DeepSeek بنتيجة 82.7 على Terminal Bench 2.1، و76.7 على CyberGym، و54.4 على DeepSWE، و70.3 على Toolathlon-Verified، و54.2 على NL2Repo. استخدمت التقييمات العامة لوكيل البرمجة الوضع الأدنى غير المنشور من DeepSeek Harness مع أقصى جهد استدلالي.
هل DeepSeek V4 Flash 0731 مفتوح المصدر؟
أوزان النموذج والمستودع منشورة تحت رخصة MIT، لذا فإن وصف "الأوزان المفتوحة" والاستخدام المسموح على نطاق واسع يعد دقيقًا. لا يزال تشغيل نقطة التفتيش الكاملة يتطلب بنية تحتية كبيرة متعددة وحدات معالجة الرسوميات.
هل يمكن تشغيل DeepSeek V4 Flash محليًا؟
نعم، تنشر DeepSeek الأوزان وتعليمات الخدمة لـ vLLM و SGLang. تستخدم الأمثلة الرسمية على نطاق كامل أجهزة متقدمة متعددة وحدات معالجة الرسوميات، لذا فإن الكمبيوتر المحمول العادي ليس البيئة المستهدفة للنموذج الكامل.
ما هي نافذة السياق؟
تحدد واجهة برمجة التطبيقات الرسمية وبطاقة النموذج نافذة سياق تبلغ مليون رمز. كما تسرد الواجهة أيضًا
الحد الأقصى لطول الإخراج هو 384 ألف رمز، ولكن استخدام الحد الأقصى للسياق أو الإخراج يمكن أن يزيد بشكل كبير من زمن الاستجابة واستخدام الموارد.
هل تم إصدار DeepSeek Code أو DeepSeek Harness؟
أشارت DeepSeek علنًا إلى وضع Harness المبسّط وقامت بتوظيف مطوّري أدوات مفتوحة المصدر للاختبار الداخلي. لم يتم العثور على مستودع عام كامل أو مواصفات منتج نهائية أو تاريخ إصدار مؤكد أثناء عملية التحقق.
الأدوات ذات الصلة
- DeepSeek API: المنصة الرسمية للمفاتيح والفواتير والوصول المباشر إلى نماذج DeepSeek.
- DeepSeek V4 Flash 0731 على Hugging Face: نقطة التحقق الرسمية مفتوحة الأوزان، وبطاقة النموذج، وجدول المعايير، والترخيص، وتعليمات النشر.
- vLLM: محرك خدمة مفتوح المصدر عالي الإنتاجية مع دعم DeepSeek V4 و DSpark.
- SGLang: إطار عمل خدمة مفتوح المصدر مع مسار نشر منشور لـ V4 Flash 0731.
- OpenCode: وكيل برمجة مفتوح المصدر تقدم خدمته Zen حاليًا خيار V4 Flash مجاني لفترة محدودة.
- Cline: وكيل برمجة ومنصة نماذج مفتوح المصدر تقدم DeepSeek V4 Flash من خلال نظام مزوديها.
- Nous Portal: منصة استدلال متعددة النماذج أطلقت عرضًا ترويجيًا محدودًا لـ DeepSeek V4 Flash.
- Artificial Analysis: منصة تحليل نماذج مستقلة تغطي الذكاء والسرعة والسعر وتكلفة المعايير.
الروابط ذات الصلة
- سجل تغييرات DeepSeek ليوم 31 يوليو: حالة الإصدار الرسمية، ونتائج المعايير، وملاحظات المنهجية، ونطاق API، وبيان ما بعد التدريب.
- نماذج DeepSeek والأسعار: الأسعار الرسمية الحالية، وطول السياق، وحد الإخراج، والميزات، والتزامن.
- بطاقة نموذج DeepSeek V4 Flash 0731: ملاحظات البنية، ومقارنة المعايير، ومستويات جهد الاستدلال، وتكوين DSpark، وترخيص MIT.
- البطاقة الفنية لنموذج DeepSeek V4: بنية V4 الأصلية، وأعداد المعلمات، والتقرير الفني، وتقييم عائلة النماذج.
- دليل وضع التفكير في DeepSeek: إرشادات رسمية لمخرجات الاستدلال والحفاظ على
reasoning_contentعبر استدعاءات الأدوات. - تكاملات وكيل DeepSeek: مثال رسمي لربط V4 Flash بأداة برمجة طرفية.
- نماذج OpenCode Zen: كتالوج النماذج الحالي ومعلومات النماذج المجانية لفترة محدودة.
- تقييم Artificial Analysis لـ V4 Flash 0731: النتيجة المركبة المستقلة، والسعر، وتقييم الوكيل، وملاحظات الموثوقية.
الملخص
يحافظ DeepSeek V4 Flash 0731 على أساس نموذج Preview
البنية والحجم ولكنها تستخدم تدريبًا لاحقًا جديدًا لإنتاج قفزة كبيرة في أداء وكلاء البرمجة. تبلغ DeepSeek عن 82.7 في Terminal Bench 2.1، و76.7 في CyberGym، و54.4 في DeepSWE، على الرغم من أن أقوى نتائج وكلاء التعليمات البرمجية العامة تعتمد على إعداد DeepSeek Harness غير المنشور.
سعر واجهة برمجة التطبيقات الرسمية منخفض بشكل غير معتاد: 0.14 دولار لكل مليون رمز إدخال غير مخزّن مؤقتًا، و0.0028 دولار لكل مليون رمز إدخال مخزّن مؤقتًا، و0.28 دولار لكل مليون رمز إخراج. يمكن للحصص المجانية والخصومات من الأطراف الثالثة أن تجعل الوصول أرخص، ولكن هذه العروض الترويجية مؤقتة ولا ينبغي الخلط بينها وبين السعر الدائم المعلن.
الإصدار مفتوح الأوزان بترخيص MIT، وسياق مليون رمز، وواجهات برمجة التطبيقات المتوافقة مع Responses وAnthropic، والدعم في vLLM وSGLang يجعل النموذج متاحًا عبر المسارات المستضافة والمدارة ذاتيًا. يظل النشر المحلي الكامل مشروع بنية تحتية جادًا متعدد وحدات معالجة الرسوميات.
النموذجان الأوليان اللذان تبلغ تكلفتهما سبعة سنتات وخمسين سنتًا هما مثالان معقولان على مدى انخفاض الفاتورة الحدية للنموذج، لكنهما ليسا دراستين كاملتين لتكلفة المنتج. حلقات الوكيل، وطول المخرجات، وفقدان الذاكرة المؤقتة، والأدوات، والاختبار، والعمل البشري كلها أمور لا تزال مهمة.
DeepSeek V4 Flash 0731 مهم ليس لأن كل تطبيق أصبح الآن يكلف بضعة سنتات، ولكن لأن البرمجة الوكيلة القادرة أصبحت رخيصة بما يكفي لعدد أكبر بكثير من المطورين لتجربتها على نطاق ذي معنى.