01.AI

Yi-Lightning

قيد التقييم
الجهة الصانعة
01.AI
المنشأ
الصين
تاريخ الإصدار
أكتوبر 2024

نقاط القوة والضعف

  • نموذج سريع ومنخفض التكلفة وأداؤه جيد مقابل سعره
  • تغطية معقولة لعدة لغات منها الإنجليزية والصينية
  • يتأخر عن نماذج الصدارة في الاستدلال والبرمجة المعقدة
  • منظومة مطورين أصغر من Qwen أو DeepSeek

التقييم

قيد القياس · 60% مقاس

قُيّم على Yi-Lightning · بيانات المصادر حتى 26 سبتمبر 2026

  • Reasoningw457.0

    قاعدة B1,302 rating (95% 1,294–1,310) من 6,961 صوتًا · المقياس 700–1,550، من 0 إلى 10 · LMArena text arena, hard prompts (yi-lightning) · 25 سبتمبر 2026

  • Accuracyw20—

    لا يوجد قياس مستقل بعد

  • Writingw156.5

    قاعدة B1,280 rating (95% 1,270–1,290) من 3,781 صوتًا · المقياس 750–1,550، من 0 إلى 10 · LMArena text arena, creative writing (yi-lightning) · 25 سبتمبر 2026

  • Long contextw20—

    لا يوجد قياس مستقل بعد

السعر والإتاحة

مقاسان بالطريقة نفسها، وخارج الدرجة عن عمد: تكلفة النموذج لا تغيّر ما يستطيع فعله.

  • Cost efficiencyخارج التقييم—

    لا يوجد قياس مستقل بعد

  • Deployabilityخارج التقييم—

    لا يوجد قياس مستقل بعد

w = الوزن، أي حصة كل معيار من الدرجة الإجمالية. والدرجات الغائبة لا تُحتسب لصالح النموذج ولا ضده. كيف يعمل التقييم

المزيد في نماذج اللغة

عرض الكل →
Anthropic
قيد التقييم
  • يتصدّر LMArena وحده في المسائل الصعبة (1,545) وفي ساحة WebDev (1,827)، وهو أعلى تقييم على أيٍّ من اللوحتين
  • تذكر Anthropic انخفاضًا يقارب 40% في كلفة المهمة عن Opus 5 وسرعة إخراج أعلى بأكثر من 30%، بسعر 4/20 دولارًا لكل مليون رمز
  • صدر قبل أسابيع، فما زالت الكتابة الإبداعية دون حدّ الأصوات في هذا الموقع ولا يوجد اختبار هلوسة بعد — ودرجته الإجمالية معلّقة
  • لا يزال في الطبقة الأغلى: أضعاف سعر النماذج السريعة التي يجري عليها معظم العمل كثيف الحجم
OpenAI
8.8/10
  • المركز الخامس من 133 في ساحة WebDev على LMArena، وهو أقوى حضور لـ OpenAI في بناء تطبيقات ويب عاملة بعد Astra
  • اتساق وقائعي 93.5% على لوحة Vectara للهلوسة، متقدمًا على GPT-6 Astra البالغ 91.3%
  • المركز 156 من 409 في ساحة النصوص العامة على LMArena — ففي المقارنات العمياء يفضّل الناس عليه نماذج كثيرة أرخص
  • يقع دون Astra في تشكيلة OpenAI نفسها، فلا يحمل قدرات النموذج الرائد
OpenAI
  • مسعّر للحجم الكبير بـ 0.10/0.50 دولار لكل مليون رمز، أي جزء من عشرين من سعر Sol، وبنافذة السياق نفسها البالغة 1.05 مليون رمز
  • مبني للأعمال المكتبية كثيفة التكرار — استخراج الحقول من المستندات وتلخيص التذاكر — حيث تهم الإنتاجية أكثر من العمق
  • المركز 160 من 409 في ساحة النصوص العامة والمركز 155 في الكتابة الإبداعية: ليس نموذجًا يُلجأ إليه في العمل الصعب أو التعبيري
  • تضعه OpenAI طبقتين دون Astra، فالاستدلال المعقّد والتشغيل الوكيل الطويل خارج مهمته
SpaceXAI
8.2/10
  • تذكر SpaceXAI أن نتيجته في Terminal-Bench 4.0 تضاعفت تقريبًا إلى 38.0% من 20.3% لـ Grok 4.6 في مهام الطرفية الممتدة لساعات
  • يحافظ على سعر Grok 4.6 البالغ 2/6 دولارات لكل مليون رمز رغم نموذج أساس أكبر وتدريب تعزيزي أطول
  • المركز 151 من 399 في مسائل LMArena الصعبة — فالمكاسب التي تذكرها الجهة الصانعة في المقاييس الوكيلة لا تظهر في التفضيل البشري الأعمى
  • تضعه أرقام SpaceXAI نفسها خلف Claude Fable 5.1 في CursorBench 4.0، 46.3% مقابل 51.8%