التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

Mistral: Mistral Small 4 vs Xiaomi: MiMo-V2-Flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-04

المقياس Mistral Small 4 Mistral Small 4 medium الإصدار: 2026-03-16 MiMo-V2-Flash MiMo-V2-Flash none الإصدار: 2025-12-16
النتيجة 5.6 4.4
الترتيب #68 #87
الاتساق 7.0 8.0
اختبارات صحيحة
معدل النجاح لكل محاولة 49.0% 27.5%
اختبارات غير مستقرة 6 4
إجمالي مرات التشغيل 51 51
التكلفة لكل نتيجة 0.502 0.743
إجمالي التكلفة $0.026 $0.023
??? ??????? $0.150 / 1M $0.090 / 1M
??? ??????? $0.600 / 1M $0.290 / 1M
رموز الإخراج 12,288 67,796
رموز الاستدلال 28,112 0
زمن الاستجابة (المتوسط) 4.18s 2.79s
زمن الاستجابة (الحد الأقصى) 25.25s 19.68s
زمن الاستجابة (الإجمالي) 71.03s 36.29s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
MiMo-V2-Flash 3.2 8.0 8.3% 1 1.19s 865 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
MiMo-V2-Flash 3.0 10.0 0.0% 0 2.87s 330 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
MiMo-V2-Flash 2.9 5.8 16.7% 1 19.68s 161 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
MiMo-V2-Flash 5.3 7.2 44.4% 1 564ms 24 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
MiMo-V2-Flash 4.6 10.0 0.0% 0 1.67s 104 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
MiMo-V2-Flash 6.5 10.0 50.0% 0 857ms 69 0
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
MiMo-V2-Flash 3.6 7.2 22.2% 1 1.38s 65,971 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
MiMo-V2-Flash 10.0 10.0 100.0% 0 2.28s 272 0

مقارنة سريعة

تبديل زوج المقارنة