التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

MiniMax: MiniMax M2.7 vs OpenAI: GPT-4o-mini

الملخص

مقارنة benchmark بين MiniMax M2.7 و GPT-4o-mini: يتقدم MiniMax M2.7 في متوسط النتيجة بـ 5.2 مقابل 5.0. لدى GPT-4o-mini تكلفة benchmark أقل عند $0.006 مقابل $0.075. GPT-4o-mini أسرع عند 1.77s مقابل 38.18s، مع معدلات نجاح 46.0% مقابل 23.8%.

النموذج الموصى به: GPT-4o-mini - Its score stays close to the best score here (5.0 vs 5.2), while costing about 12.6x less than MiniMax M2.7.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-02

المقياس MiniMax M2.7 MiniMax M2.7 medium الإصدار: 2026-03-18 GPT-4o-mini GPT-4o-mini none الإصدار: 2024-07-18
النتيجة 5.2 5.0
الترتيب #132 #144
الموثوقية 10.0 10.0
الاتساق 6.8 9.9
اختبارات صحيحة
معدل النجاح لكل محاولة 46.0% 23.8%
اختبارات غير مستقرة 8 0
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 2.494 0.119
إجمالي التكلفة $0.075 $0.006
سعر الإدخال $0.180 / 1M $0.150 / 1M
سعر الإخراج $0.720 / 1M $0.600 / 1M
إجمالي رموز الإدخال 34,371 31,518
رموز الإخراج 8,981 1,982
رموز الاستدلال 89,812 0
زمن الاستجابة (المتوسط) 38.18s 1.77s
زمن الاستجابة (الحد الأقصى) 196.21s 7.58s
زمن الاستجابة (الإجمالي) 763.60s 24.80s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#132 MiniMax M2.7

medium
التكلفة
$0.022
الوقت
22.8s
الرموز
9,250 tok

#144 GPT-4o-mini

none
التكلفة
$0.001
الوقت
6.6s
الرموز
742 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 654 3,010 17,716
GPT-4o-mini 4.8 10.0 25.0% 0 1.34s 618 186 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 5.7 9.1 33.3% 0 101.89s 2,961 1,231 38,841
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 14,233 369 4,480
GPT-4o-mini 3.0 10.0 0.0% 0 7.58s 8,298 568 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 7,152 187 5,882
GPT-4o-mini 10.0 10.0 100.0% 0 1.27s 7,161 183 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 245 8 2,796
GPT-4o-mini 3.0 10.0 0.0% 0 637ms 732 15 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 486 92 5,204
GPT-4o-mini 4.0 10.0 0.0% 0 909ms 480 66 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.8 5.8 33.3% 1 12.80s 687 350 2,600
GPT-4o-mini 6.3 10.0 50.0% 0 1.11s 666 69 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 5.9 7.2 55.6% 1 24.87s 675 362 7,840
GPT-4o-mini 3.5 10.0 0.0% 0 1.21s 651 308 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 7,067 304 1,001
GPT-4o-mini 10.0 10.0 100.0% 0 2.51s 5,400 205 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
MiniMax M2.7 3.0 10.0 0.0% 0 22.77s 211 3,068 3,452
GPT-4o-mini 3.0 10.0 0.0% 0 794ms 198 15 0

مقارنة سريعة

تبديل زوج المقارنة