التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MiniMax: MiniMax M2.7 vs StepFun: Step 3.5 Flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-11

المقياس MiniMax M2.7 MiniMax M2.7 medium الإصدار: 2026-03-18 Step 3.5 Flash Step 3.5 Flash none الإصدار: 2026-02-01
النتيجة 5.3 3.0
الترتيب #76 #93
الاتساق 5.5 10.0
اختبارات صحيحة
معدل النجاح لكل محاولة 51.9% 0.0%
اختبارات غير مستقرة 10 0
إجمالي مرات التشغيل 54 3
التكلفة لكل نتيجة 2.273 0.000
إجمالي التكلفة $0.091 $0.000
??? ??????? $0.300 / 1M $0.100 / 1M
??? ??????? $1.200 / 1M $0.300 / 1M
رموز الإخراج 4,984 0
رموز الاستدلال 62,787 0
زمن الاستجابة (المتوسط) 31.08s 0ms
زمن الاستجابة (الحد الأقصى) 117.04s 0ms
زمن الاستجابة (الإجمالي) 528.37s 0ms

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 3,010 17,716
Step 3.5 Flash - - - - - - - -
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 10.0 10.0 100.0% 0 91.27s 467 15,175
Step 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 369 4,480
Step 3.5 Flash - - - - - - - -
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 187 5,882
Step 3.5 Flash - - - - - - - -
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 8 2,796
Step 3.5 Flash - - - - - - - -
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 92 5,204
Step 3.5 Flash - - - - - - - -
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.7 1.8 50.0% 2 12.64s 213 2,457
Step 3.5 Flash - - - - - - - -
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.8 4.5 33.3% 2 25.62s 334 8,076
Step 3.5 Flash - - - - - - - -
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 304 1,001
Step 3.5 Flash - - - - - - - -

مقارنة سريعة

تبديل زوج المقارنة