النماذج / البرمجة والوكلاء النموذج نفسه المدرج باسم Gemini 3 Pro ضمن نماذج اللغة، ومدرج هنا مرة أخرى لأنه يُستخدم نموذجًا برمجيًا ويُقيَّم وفق معايير تلك الفئة. ويُحتسب مرة واحدة في إجماليات الدليل.
الجهة الصانعة Google
تاريخ الإصدار 5 فبراير 2026 نقاط القوة والضعف + يحل 69.6% من مسائل SWE-bench Verified على الإطار المفتوح المعياري + استدلال عام أقوى من فئة Flash، ويظهر ذلك في المسائل التي تحتاج حكمًا معماريًا − درجته أقل من فئة Flash التابعة له على إطار SWE-bench نفسه، فدفع ثمن Pro لا يشتري إصلاحًا أفضل للمسائل − غير متاح عبر OpenRouter، فلا يُقاس سعره ونافذة سياقه هنا بشكل مستقل
التقييم 85% من الوزن مقاس قُيّم على Gemini 3 Pro · بيانات المصادر حتى 26 سبتمبر 2026
نطاق الثقة 6.1–6.2 · أي نموذج داخل هذا النطاق لا يفصله فارق ذو معنى عن هذا النموذج
السعر والإتاحة مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.
w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم
+ خليط خبراء بـ 600 مليار معامل منها 27 مليارًا نشطة ونافذة مليون رمز، مبني للعمل الوكيل طويل الأمد + دولار واحد للإدخال و2.70 دولار للإخراج لكل مليون رمز، مع وعد بفتح الأوزان في أكتوبر 2026 − أنتج نحو 1.7 ضعف وسيط رموز الإخراج في مؤشر Artificial Analysis، فالكلفة الفعلية أعلى بكثير من السعر المعلن − إصدار تجريبي بلا نتيجة مستقلة في مقاييس البرمجة بعد، فلا يحمل درجة إجمالية هنا
+ أتمتة ممتازة لسطر الأوامر وعمليات git وتتبّع أعطال CI/CD + أوفر بكثير في التوكن من منافسيه كثيفي الاستدلال في المهام الروتينية − يحتاج تعليمات مفصّلة لا لبس فيها؛ ويتعثّر مع الطلبات المبهمة − نافذة سياق أصغر من بعض منافسيه، وهو قيد على المستودعات الضخمة
+ قوي في استنتاج المقصود من الطلبات المبهمة ومن السياق المعماري + سياق بمليون توكن يدعم إعادة هيكلة متماسكة عبر ملفات ومستودعات متعددة − قد يستهلك توكن أكثر بكثير من نماذج برمجية أخف في العمل الروتيني − يسرد استدلاله بإسهاب، ما يبطئ المهام السريعة
+ أداء مفتوح الأوزان قريب من المتصدّرين المملوكين + مجاني للاستضافة الذاتية، وجذاب للفرق الحساسة للتكلفة أو المعزولة عن الإنترنت − يحتاج بنية تحتية جادة لتشغيله بحجمه الكامل − أدواته وتكاملاته مع بيئات التطوير أقل نضجًا من Copilot أو Cursor أو Codex