التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemma 4 31B vs Xiaomi: MiMo-V2.5

الملخص

مقارنة benchmark بين Gemma 4 31B و MiMo-V2.5: يتقدم MiMo-V2.5 في متوسط النتيجة بـ 6.7 مقابل 6.1. لدى Gemma 4 31B تكلفة benchmark أقل عند $0.004 مقابل $0.063. Gemma 4 31B أسرع عند 4.05s مقابل 27.11s، مع معدلات نجاح 47.6% مقابل 69.8%.

النموذج الموصى به: Gemma 4 31B - Its score stays close to the best score here (6.1 vs 6.7), while costing about 20.8x less than MiMo-V2.5.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-18

المقياس Gemma 4 31B Gemma 4 31B none الإصدار: 2026-04-02 متاح مجانًا MiMo-V2.5 MiMo-V2.5 medium الإصدار: 2026-04-22
النتيجة 6.1 6.7
الترتيب #98 #76
الموثوقية 10.0 10.0
الاتساق 10.0 8.1
اختبارات صحيحة
معدل النجاح لكل محاولة 47.6% 69.8%
اختبارات غير مستقرة 0 5
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.034 2.966
إجمالي التكلفة $0.004 $0.063
سعر الإدخال $0.120 / 1M $0.140 / 1M
سعر الإخراج $0.350 / 1M $0.280 / 1M
إجمالي رموز الإدخال 20,911 41,838
رموز الإخراج 1,407 2,827
رموز الاستدلال 0 198,898
زمن الاستجابة (المتوسط) 4.05s 27.11s
زمن الاستجابة (الحد الأقصى) 26.13s 162.44s
زمن الاستجابة (الإجمالي) 76.87s 569.38s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Gemma 4 31B

none
التكلفة
$0.001
الوقت
12.8s
الرموز
795 tok

#76 MiMo-V2.5

medium
التكلفة
$0.002
الوقت
54.8s
الرموز
5,247 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 852 45 0
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 8,352 285 0
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 903 27 0
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 576 117 0
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 795 78 0
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 6.5 10.0 33.3% 0 4.23s 828 108 0
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 224 12 0
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

مقارنة سريعة

تبديل زوج المقارنة