AI BENCHY Compare

OpenAI: GPT-5.5 vs Mimo V2 Omni

الملخص

مقارنة benchmark بين GPT-5.5 و Mimo V2 Omni: يتقدم GPT-5.5 في متوسط النتيجة بـ 9.3 مقابل 6.8. لدى Mimo V2 Omni تكلفة benchmark أقل عند $0.683 مقابل $0.907. GPT-5.5 أسرع عند 9.76s مقابل 41.16s، مع معدلات نجاح 85.7% مقابل 55.6%.

النموذج الموصى به: GPT-5.5 - It has the best score here (9.3), while responding about 4.2x faster than Mimo V2 Omni.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-18

المقياس	GPT-5.5 GPT-5.5 low الإصدار: 2026-04-24	Mimo V2 Omni Mimo V2 Omni medium الإصدار: 2026-03-18

المقياس	GPT-5.5 GPT-5.5 low الإصدار: 2026-04-24	Mimo V2 Omni Mimo V2 Omni medium الإصدار: 2026-03-18
النتيجة	9.3	6.8
الترتيب	#4	#73
الموثوقية	10.0	10.0
الاتساق	10.0	8.7
اختبارات صحيحة
معدل النجاح لكل محاولة	85.7%	55.6%
اختبارات غير مستقرة	0	3
إجمالي مرات التشغيل	63	55
التكلفة لكل نتيجة	5.035	7.334
إجمالي التكلفة	$0.907	$0.683
سعر الإدخال	$5.000 / 1M	$1.722 / 1M
سعر الإخراج	$30.000 / 1M	$1.722 / 1M
إجمالي رموز الإدخال	34,209	37,007
رموز الإخراج	2,046	1,952
رموز الاستدلال	22,460	357,306
زمن الاستجابة (المتوسط)	9.76s	41.16s
زمن الاستجابة (الحد الأقصى)	56.19s	299.23s
زمن الاستجابة (الإجمالي)	204.92s	823.26s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#4 GPT-5.5

low

التكلفة: $0.068
الوقت: 37.0s
الرموز: 2,339 tok

#73 Mimo V2 Omni

medium

This model has been deprecated. It is recommended to migrate to xiaomi/mimo-v2.5

التكلفة: $0.000
الوقت: 0.1s
الرموز: 0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		4.41s	606	238	1,020
Mimo V2 Omni	10.0	10.0	100.0%	0		2.75s	621	269	1,701

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		15.04s	7,302	423	6,402
Mimo V2 Omni	3.3	6.5	11.1%	1		183.89s	4,787	292	174,314

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		9.56s	11,019	303	717
Mimo V2 Omni	10.0	10.0	100.0%	0		25.87s	15,060	380	8,673

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		3.28s	7,140	228	157
Mimo V2 Omni	10.0	10.0	100.0%	0		3.04s	6,002	155	591

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	5.3	10.0	33.3%	0		28.05s	723	69	11,609
Mimo V2 Omni	3.0	10.0	0.0%	0		47.89s	735	155	68,398

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		5.17s	477	133	245
Mimo V2 Omni	5.4	2.5	66.7%	1		3.61s	492	136	492

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	9.9	10.0	100.0%	0		3.74s	660	93	415
Mimo V2 Omni	8.3	10.0	50.0%	0		4.99s	470	49	515

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		4.74s	642	279	954
Mimo V2 Omni	5.9	7.2	55.6%	1		2.38s	410	210	860

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		4.96s	5,445	250	101
Mimo V2 Omni	10.0	10.0	100.0%	0		13.98s	8,220	303	3,461

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	3.0	10.0	0.0%	0		10.06s	195	30	840
Mimo V2 Omni	3.0	10.0	0.0%	0		234.19s	210	3	98,301

مقارنة سريعة

تبديل زوج المقارنة

GPT-5.5lowvsQwen3.7 Maxmedium Claude Fable 5mediumvsGPT-5.5low Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Gemini 3.5 FlashmediumvsGPT-5.5low Gemini 3 Flash PreviewmediumvsGPT-5.5low GPT-5.5lowvsQwen3.6 Max Previewmedium Claude Opus 4.8mediumvsGPT-5.5low Gemini 3.5 FlashhighvsGPT-5.5low Claude Opus 4.7mediumvsGPT-5.5low GPT-5.5lowvsGLM 5.2medium GPT-5.5lowvsGLM 5medium Seed-2.0-LitemediumvsGPT-5.5low