التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs MiniMax: MiniMax M2.5

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-29

المقياس Gemini 3 Flash Preview Gemini 3 Flash Preview medium الإصدار: 2025-12-17 MiniMax M2.5 MiniMax M2.5 medium الإصدار: 2026-02-12 متاح مجانًا
النتيجة 10.0 5.7
الترتيب #1 #94
الموثوقية غير متاح غير متاح
الاتساق 10.0 5.6
اختبارات صحيحة
معدل النجاح لكل محاولة 100.0% 57.4%
اختبارات غير مستقرة 0 10
إجمالي مرات التشغيل 18 54
التكلفة لكل نتيجة 0.600 4.987
إجمالي التكلفة $0.108 $0.250
??? ??????? $0.500 / 1M $0.150 / 1M
??? ??????? $3.000 / 1M $1.150 / 1M
رموز الإخراج 655 107,044
رموز الاستدلال 33,749 206,422
زمن الاستجابة (المتوسط) 12.11s 39.65s
زمن الاستجابة (الحد الأقصى) 82.37s 237.27s
زمن الاستجابة (الإجمالي) 217.93s 396.47s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.26s 110 1,076
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 286 45,344
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 82.37s 144 16,257
MiniMax M2.5 3.0 10.0 0.0% 0 0ms 0 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 23.58s 117 3,495
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 740 9,713
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 7.62s 93 2,197
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 266 3,835
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 14.81s 4 7,228
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 105,047 133,487
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.34s 24 635
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 25 1,686
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.30s 24 903
MiniMax M2.5 8.1 6.8 83.3% 1 4.64s 252 1,873
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.86s 61 1,455
MiniMax M2.5 5.3 7.2 44.4% 1 11.54s 159 9,547
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 9.78s 78 503
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 269 937

مقارنة سريعة

تبديل زوج المقارنة