OpenAI

GPT-6 Astra

قيد التقييم

النموذج نفسه المدرج باسم GPT-6 Astra ضمن نماذج اللغة، ومدرج هنا مرة أخرى لأنه يُستخدم نموذجًا برمجيًا ويُقيَّم وفق معايير تلك الفئة. ويُحتسب مرة واحدة في إجماليات الدليل.

الجهة الصانعة
OpenAI
المنشأ
الولايات المتحدة
تاريخ الإصدار
3 سبتمبر 2026

نقاط القوة والضعف

  • مصنّف الأول من 128 نموذجًا في ساحة WebDev على LMArena حيث يحكم الناس على تطبيقات ويب عاملة — بفارق 42 نقطة عن التالي
  • نافذة سياق بـ1,050,000 توكن، فيتسع مستودع كبير في مرور واحد
  • لا نتيجة له بعد على الإطار المعياري لـSWE-bench Verified، فمهارته في إصلاح مسائل المستودعات الحقيقية غير مقاسة هنا
  • سعره في أعلى السوق، نحو 20 دولارًا لكل مليون توكن مخلوط

التقييم

قيد القياس · 55% مقاس

قُيّم على GPT 6 Astra (Max) · بيانات المصادر حتى 26 سبتمبر 2026

  • Code qualityw45—

    لا يوجد قياس مستقل بعد

  • Web developmentw409.7

    قاعدة B1,792 rating (95% 1,780–1,803) من 4,908 صوتًا · المقياس 1,050–1,800، من 0 إلى 10 · LMArena WebDev arena (gpt-6-astra-max) · 25 سبتمبر 2026

  • Codebase contextw1510.0

    قاعدة B1,050,000 tokens · المقياس 8,192–1,048,576 توكن، من 0 إلى 10 · OpenRouter, context window · 26 سبتمبر 2026

السعر والإتاحة

مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.

  • Cost efficiencyخارج التقييم0.6

    قاعدة B$20.00 per 1M tokens (blended) · المقياس 30–0.05، من 0 إلى 10 · OpenRouter, blended price per token · 26 سبتمبر 2026

w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم

المزيد في البرمجة والوكلاء

عرض الكل →
StepFun
قيد التقييم
  • خليط خبراء بـ 600 مليار معامل منها 27 مليارًا نشطة ونافذة مليون رمز، مبني للعمل الوكيل طويل الأمد
  • دولار واحد للإدخال و2.70 دولار للإخراج لكل مليون رمز، مع وعد بفتح الأوزان في أكتوبر 2026
  • أنتج نحو 1.7 ضعف وسيط رموز الإخراج في مؤشر Artificial Analysis، فالكلفة الفعلية أعلى بكثير من السعر المعلن
  • إصدار تجريبي بلا نتيجة مستقلة في مقاييس البرمجة بعد، فلا يحمل درجة إجمالية هنا
OpenAI
قيد التقييم
  • أتمتة ممتازة لسطر الأوامر وعمليات git وتتبّع أعطال CI/CD
  • أوفر بكثير في التوكن من منافسيه كثيفي الاستدلال في المهام الروتينية
  • يحتاج تعليمات مفصّلة لا لبس فيها؛ ويتعثّر مع الطلبات المبهمة
  • نافذة سياق أصغر من بعض منافسيه، وهو قيد على المستودعات الضخمة
Anthropic
  • قوي في استنتاج المقصود من الطلبات المبهمة ومن السياق المعماري
  • سياق بمليون توكن يدعم إعادة هيكلة متماسكة عبر ملفات ومستودعات متعددة
  • قد يستهلك توكن أكثر بكثير من نماذج برمجية أخف في العمل الروتيني
  • يسرد استدلاله بإسهاب، ما يبطئ المهام السريعة
Alibaba
  • أداء مفتوح الأوزان قريب من المتصدّرين المملوكين
  • مجاني للاستضافة الذاتية، وجذاب للفرق الحساسة للتكلفة أو المعزولة عن الإنترنت
  • يحتاج بنية تحتية جادة لتشغيله بحجمه الكامل
  • أدواته وتكاملاته مع بيئات التطوير أقل نضجًا من Copilot أو Cursor أو Codex