النماذج / البرمجة والوكلاء النموذج نفسه المدرج باسم GLM-5 ضمن نماذج اللغة، ومدرج هنا مرة أخرى لأنه يُستخدم نموذجًا برمجيًا ويُقيَّم وفق معايير تلك الفئة. ويُحتسب مرة واحدة في إجماليات الدليل.
الجهة الصانعة Zhipu AI
تاريخ الإصدار 20 يناير 2026 نقاط القوة والضعف + يحل 72.8% من مسائل SWE-bench Verified، وهو أفضل نتيجة مفتوحة الأوزان مقاسة في هذا الدليل + أوزان مفتوحة يقدّمها عدة مستضيفين مستقلين، فيستطيع الفريق تشغيله داخل بيئته − مصنّف دون فئات الصدارة المغلقة في ساحة WebDev − سياق بـ200 ألف توكن يبقى مقيِّدًا أمام فئات المليون توكن عند العمل عبر مستودع كبير
التقييم 100% من الوزن مقاس قُيّم على GLM-5 · بيانات المصادر حتى 26 سبتمبر 2026
نطاق الثقة 6.3–6.4 · أي نموذج داخل هذا النطاق لا يفصله فارق ذو معنى عن هذا النموذج
Code qualityw45 7.3
قاعدة A 72.8% resolved · 72.8% ÷ 10 · SWE-bench Verified, % resolved (mini-SWE-agent harness) (GLM 5) · 17 فبراير 2026
Web developmentw40 5.0
قاعدة B 1,434 rating (95% 1,426–1,442) من 7,504 صوتًا · المقياس 1,050–1,800، من 0 إلى 10 · LMArena WebDev arena (glm-5) · 25 سبتمبر 2026
Codebase contextw15 6.6
قاعدة B 204,800 tokens · المقياس 8,192–1,048,576 توكن، من 0 إلى 10 · OpenRouter, context window · 26 سبتمبر 2026
السعر والإتاحة مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.
w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم
+ خليط خبراء بـ 600 مليار معامل منها 27 مليارًا نشطة ونافذة مليون رمز، مبني للعمل الوكيل طويل الأمد + دولار واحد للإدخال و2.70 دولار للإخراج لكل مليون رمز، مع وعد بفتح الأوزان في أكتوبر 2026 − أنتج نحو 1.7 ضعف وسيط رموز الإخراج في مؤشر Artificial Analysis، فالكلفة الفعلية أعلى بكثير من السعر المعلن − إصدار تجريبي بلا نتيجة مستقلة في مقاييس البرمجة بعد، فلا يحمل درجة إجمالية هنا
+ أتمتة ممتازة لسطر الأوامر وعمليات git وتتبّع أعطال CI/CD + أوفر بكثير في التوكن من منافسيه كثيفي الاستدلال في المهام الروتينية − يحتاج تعليمات مفصّلة لا لبس فيها؛ ويتعثّر مع الطلبات المبهمة − نافذة سياق أصغر من بعض منافسيه، وهو قيد على المستودعات الضخمة
+ قوي في استنتاج المقصود من الطلبات المبهمة ومن السياق المعماري + سياق بمليون توكن يدعم إعادة هيكلة متماسكة عبر ملفات ومستودعات متعددة − قد يستهلك توكن أكثر بكثير من نماذج برمجية أخف في العمل الروتيني − يسرد استدلاله بإسهاب، ما يبطئ المهام السريعة
+ أداء مفتوح الأوزان قريب من المتصدّرين المملوكين + مجاني للاستضافة الذاتية، وجذاب للفرق الحساسة للتكلفة أو المعزولة عن الإنترنت − يحتاج بنية تحتية جادة لتشغيله بحجمه الكامل − أدواته وتكاملاته مع بيئات التطوير أقل نضجًا من Copilot أو Cursor أو Codex