AI BENCHY Compare

Cobuddy vs OpenAI: GPT-5.4 Mini

الملخص

مقارنة benchmark بين Cobuddy و GPT-5.4 Mini: يتقدم GPT-5.4 Mini في متوسط النتيجة بـ 5.3 مقابل 4.9. لدى Cobuddy تكلفة benchmark أقل عند $0.000 مقابل $0.038. GPT-5.4 Mini أسرع عند 1.13s مقابل 39.90s، مع معدلات نجاح 47.6% مقابل 30.2%.

النموذج الموصى به: GPT-5.4 Mini - It has the best score here (5.3), while responding about 35.2x faster than Cobuddy.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-12

المقياس	Cobuddy Cobuddy medium الإصدار: 2026-05-06	GPT-5.4 Mini GPT-5.4 Mini none الإصدار: 2026-03-17

المقياس	Cobuddy Cobuddy medium الإصدار: 2026-05-06	GPT-5.4 Mini GPT-5.4 Mini none الإصدار: 2026-03-17
النتيجة	4.9	5.3
الترتيب	#144	#131
الموثوقية	10.0	10.0
الاتساق	7.5	8.8
اختبارات صحيحة
معدل النجاح لكل محاولة	47.6%	30.2%
اختبارات غير مستقرة	6	3
إجمالي مرات التشغيل	63	63
التكلفة لكل نتيجة	0.000	0.743
إجمالي التكلفة	$0.000	$0.038
سعر الإدخال	$0.000 / 1M	$0.750 / 1M
سعر الإخراج	$0.000 / 1M	$4.500 / 1M
إجمالي رموز الإدخال	37,449	34,244
رموز الإخراج	1,677	2,541
رموز الاستدلال	116,703	0
زمن الاستجابة (المتوسط)	39.90s	1.13s
زمن الاستجابة (الحد الأقصى)	309.02s	2.52s
زمن الاستجابة (الإجمالي)	797.98s	23.82s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 Cobuddy

medium

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

#131 GPT-5.4 Mini

none

Cost: $0.010
Time: 11.7s
Tokens: 2,151 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	8.7	7.9	91.7%	1		10.00s	453	98	4,666
GPT-5.4 Mini	3.1	8.1	8.3%	1		929ms	606	654	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	3.7	6.7	22.2%	1		79.17s	4,726	358	30,138
GPT-5.4 Mini	5.5	10.0	33.3%	0		913ms	7,305	401	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	3.0	10.0	0.0%	0		47.38s	18,324	465	7,265
GPT-5.4 Mini	3.0	10.0	0.0%	0		2.52s	11,019	298	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	6.3	5.8	66.7%	1		17.36s	8,181	275	5,591
GPT-5.4 Mini	10.0	10.0	100.0%	0		1.30s	7,140	222	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	2.9	4.4	22.2%	2		128.15s	540	10	49,454
GPT-5.4 Mini	3.5	4.4	33.3%	2		937ms	723	88	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	4.2	9.9	0.0%	0		23.23s	498	76	3,782
GPT-5.4 Mini	4.8	10.0	0.0%	0		1.82s	477	174	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	9.8	10.0	100.0%	0		11.60s	508	64	2,842
GPT-5.4 Mini	6.3	10.0	50.0%	0		728ms	660	101	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	3.6	7.2	22.2%	1		12.83s	561	189	5,808
GPT-5.4 Mini	5.4	10.0	33.3%	0		836ms	642	305	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	10.0	10.0	100.0%	0		11.19s	3,505	133	294
GPT-5.4 Mini	3.0	10.0	0.0%	0		2.32s	5,477	255	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Cobuddy	3.0	10.0	0.0%	0		36.98s	153	9	6,863
GPT-5.4 Mini	3.0	10.0	0.0%	0		1.33s	195	43	0

مقارنة سريعة

تبديل زوج المقارنة

CobuddymediumvsGPT-4o-mininone CobuddymediumvsGLM 4.7 Flashnone CobuddymediumvsNemotron 3 Supernoneمتاح مجانًا CobuddymediumvsLing-2.6-flashnone Trinity Large PreviewnonevsCobuddymedium CobuddymediumvsRing-2.6-1Tnone MiniMax M2.7mediumvsGPT-5.4 Mininone CobuddymediumvsGPT-5.4 Nanonone Cobuddymediumvsgpt-oss-120bnoneمتاح مجانًا CobuddymediumvsQwen3.5-9Bnone CobuddymediumvsMiMo-V2.5none Mistral Small 4mediumvsGPT-5.4 Mininone