- الجهة الصانعة
- DeepSeek
- تاريخ الإصدار
- 24 أبريل 2026
نقاط القوة والضعف
- +نموذج صدارة مفتوح الأوزان فعليًا يمكنك استضافته بنفسك، بخلاف منافسيه المغلقين
- +تكلفة واجهة برمجية منخفضة جدًا، خصوصًا في نوافذ التسعير خارج أوقات الذروة
- −إصدار V4 Pro نصّي فقط؛ ومدخلات الصورة محصورة في نسخة Flash تجريبية
- −يتأخر عن المختبرات المغلقة الرائدة في اختبارات الذكاء المجمّعة
التقييم
100% من الوزن مقاسقُيّم على DeepSeek V4 Pro · بيانات المصادر حتى 26 سبتمبر 2026
نطاق الثقة 9.1–9.2 · أي نموذج داخل هذا النطاق لا يفصله فارق ذو معنى عن هذا النموذج
Reasoningw458.9
قاعدة B1,461 rating (95% 1,457–1,466) من 38,586 صوتًا · المقياس 700–1,550، من 0 إلى 10 · LMArena text arena, hard prompts (deepseek-v4-pro) · 25 سبتمبر 2026
Accuracyw209.1
قاعدة A91.4% consistent · 91.4% ÷ 10 · Vectara hallucination leaderboard, factual consistency rate (deepseek-ai/DeepSeek-V4-Pro) · 22 سبتمبر 2026
Writingw158.6
قاعدة B1,446 rating (95% 1,439–1,453) من 9,697 صوتًا · المقياس 750–1,550، من 0 إلى 10 · LMArena text arena, creative writing (deepseek-v4-pro) · 25 سبتمبر 2026
Long contextw2010.0
قاعدة B1,048,576 tokens · المقياس 8,192–1,048,576 توكن، من 0 إلى 10 · OpenRouter, context window · 26 سبتمبر 2026
السعر والإتاحة
مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.
w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم
- +يتصدّر LMArena وحده في المسائل الصعبة (1,545) وفي ساحة WebDev (1,827)، وهو أعلى تقييم على أيٍّ من اللوحتين
- +تذكر Anthropic انخفاضًا يقارب 40% في كلفة المهمة عن Opus 5 وسرعة إخراج أعلى بأكثر من 30%، بسعر 4/20 دولارًا لكل مليون رمز
- −صدر قبل أسابيع، فما زالت الكتابة الإبداعية دون حدّ الأصوات في هذا الموقع ولا يوجد اختبار هلوسة بعد — ودرجته الإجمالية معلّقة
- −لا يزال في الطبقة الأغلى: أضعاف سعر النماذج السريعة التي يجري عليها معظم العمل كثيف الحجم
- +المركز الخامس من 133 في ساحة WebDev على LMArena، وهو أقوى حضور لـ OpenAI في بناء تطبيقات ويب عاملة بعد Astra
- +اتساق وقائعي 93.5% على لوحة Vectara للهلوسة، متقدمًا على GPT-6 Astra البالغ 91.3%
- −المركز 156 من 409 في ساحة النصوص العامة على LMArena — ففي المقارنات العمياء يفضّل الناس عليه نماذج كثيرة أرخص
- −يقع دون Astra في تشكيلة OpenAI نفسها، فلا يحمل قدرات النموذج الرائد
- +مسعّر للحجم الكبير بـ 0.10/0.50 دولار لكل مليون رمز، أي جزء من عشرين من سعر Sol، وبنافذة السياق نفسها البالغة 1.05 مليون رمز
- +مبني للأعمال المكتبية كثيفة التكرار — استخراج الحقول من المستندات وتلخيص التذاكر — حيث تهم الإنتاجية أكثر من العمق
- −المركز 160 من 409 في ساحة النصوص العامة والمركز 155 في الكتابة الإبداعية: ليس نموذجًا يُلجأ إليه في العمل الصعب أو التعبيري
- −تضعه OpenAI طبقتين دون Astra، فالاستدلال المعقّد والتشغيل الوكيل الطويل خارج مهمته
- +تذكر SpaceXAI أن نتيجته في Terminal-Bench 4.0 تضاعفت تقريبًا إلى 38.0% من 20.3% لـ Grok 4.6 في مهام الطرفية الممتدة لساعات
- +يحافظ على سعر Grok 4.6 البالغ 2/6 دولارات لكل مليون رمز رغم نموذج أساس أكبر وتدريب تعزيزي أطول
- −المركز 151 من 399 في مسائل LMArena الصعبة — فالمكاسب التي تذكرها الجهة الصانعة في المقاييس الوكيلة لا تظهر في التفضيل البشري الأعمى
- −تضعه أرقام SpaceXAI نفسها خلف Claude Fable 5.1 في CursorBench 4.0، 46.3% مقابل 51.8%