ميزان

النتائج

ترتيب النماذج في كفّتي الميزان: «المفاضلة» و«المعيار».

الترتيبالنموذجالتقييم
800النقطة: التقييم · الخط: فترة الثقة ٩٥٪1180
المفاضلاتنسبة الفوز
١
GLM-5.3
Z.ai
١٬٠٧٠أولي١١٠٠٪
١
Qwen3.8 Max
Alibaba
١٬٠٧٠أولي١١٠٠٪
١
GPT-6 Astra
OpenAI
١٬٠٦٩أولي١١٠٠٪
١
Gemini 3.1 Pro
Google
٩٨١أولي٢٥٠٪
١
DeepSeek V4 Pro
DeepSeek
٩٥٢أولي٣٣٣٪
١
Grok 4.7
SpaceXAI
٩٥٠أولي٣٣٣٪
١
Kimi K3
Moonshot AI
٩٠٨أولي١٠٪

مجموع الأحكام: ٦. تُقدَّر القوة النسبية لكل نموذج بنموذج برادلي–تيري (الأسلوب المتبع في LMArena)، وتُحدَّث النتائج كل خمس دقائق. يُحتسب التكافؤ و«كلتاهما ضعيفة» نصف فوز لكل طرف، ويعني «أولي» أن عدد مفاضلات النموذج أقل من ٥٠.