التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

xAI: Grok Build 0.1 vs Xiaomi: MiMo-V2.5

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-21

المقياس Grok Build 0.1 Grok Build 0.1 medium الإصدار: 2026-05-21 MiMo-V2.5 MiMo-V2.5 medium الإصدار: 2026-04-22
النتيجة 7.8 7.8
الترتيب #41 #37
الموثوقية 10.0 10.0
الاتساق 8.9 8.6
اختبارات صحيحة
معدل النجاح لكل محاولة 71.9% 75.9%
اختبارات غير مستقرة 3 3
إجمالي مرات التشغيل 57 54
التكلفة لكل نتيجة 4.064 2.101
إجمالي التكلفة $0.488 $0.253
??? ??????? $1.000 / 1M $0.400 / 1M
??? ??????? $2.000 / 1M $2.000 / 1M
رموز الإخراج 1,947 2,821
رموز الاستدلال 223,372 116,207
زمن الاستجابة (المتوسط) 22.28s 14.40s
زمن الاستجابة (الحد الأقصى) 88.28s 86.93s
زمن الاستجابة (الإجمالي) 423.30s 259.20s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 10.0 10.0 100.0% 0 5.46s 195 9,825
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 281 1,739
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 7.3 3.7 66.7% 1 30.98s 354 17,734
MiMo-V2.5 10.0 10.0 100.0% 0 31.48s 488 14,813
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 10.0 10.0 100.0% 0 30.81s 231 18,779
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 363 7,609
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 10.0 10.0 100.0% 0 7.76s 180 10,343
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 306 5,714
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 5.3 10.0 33.3% 0 77.75s 501 111,807
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 507 49,478
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 3.8 2.5 33.3% 1 10.14s 78 5,386
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 121 418
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 9.8 10.0 100.0% 0 9.62s 57 12,436
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 88 801
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 6.2 7.5 55.6% 1 8.67s 161 15,476
MiMo-V2.5 8.2 7.2 88.9% 1 20.60s 364 33,211
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 10.0 10.0 100.0% 0 9.40s 180 5,319
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 303 2,424
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Grok Build 0.1 3.0 10.0 0.0% 0 26.07s 10 16,267
MiMo-V2.5 - - - - - - - -

مقارنة سريعة

تبديل زوج المقارنة