التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MiniMax: MiniMax M2.7 vs GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-02

المقياس MiniMax M2.7 MiniMax M2.7 medium الإصدار: 2026-03-18 GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT none الإصدار: تاريخ الإصدار غير معروف
النتيجة 5.0 3.0
الترتيب #76 #88
الاتساق 5.3 10.0
اختبارات صحيحة
معدل النجاح لكل محاولة 49.0% 0.0%
اختبارات غير مستقرة 10 0
إجمالي مرات التشغيل 51 48
التكلفة لكل نتيجة 2.398 0.000
إجمالي التكلفة $0.072 $0.000
??? ??????? $0.300 / 1M $0.000 / 1M
??? ??????? $1.200 / 1M $0.000 / 1M
رموز الإخراج 4,517 0
رموز الاستدلال 47,612 0
زمن الاستجابة (المتوسط) 27.32s 0ms
زمن الاستجابة (الحد الأقصى) 117.04s 0ms
زمن الاستجابة (الإجمالي) 437.10s 0ms

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 3,010 17,716
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 369 4,480
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 187 5,882
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 8 2,796
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 92 5,204
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.7 1.8 50.0% 2 12.64s 213 2,457
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.8 4.5 33.3% 2 25.62s 334 8,076
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 304 1,001
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0

مقارنة سريعة

تبديل زوج المقارنة