AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs OpenAI: GPT-5.5

الملخص

مقارنة benchmark بين GPT-5.2 Chat و GPT-5.5: يتقدم GPT-5.5 في متوسط النتيجة بـ 9.3 مقابل 8.5. لدى GPT-5.2 Chat تكلفة benchmark أقل عند $0.393 مقابل $0.907. GPT-5.2 Chat أسرع عند 7.13s مقابل 9.76s، مع معدلات نجاح 74.6% مقابل 85.7%.

النموذج الموصى به: GPT-5.2 Chat - It offers the best overall trade-off: a competitive score (8.5), lower cost than GPT-5.5, and balanced response time.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-18

المقياس	GPT-5.2 Chat GPT-5.2 Chat none الإصدار: 2025-12-11	GPT-5.5 GPT-5.5 low الإصدار: 2026-04-24

المقياس	GPT-5.2 Chat GPT-5.2 Chat none الإصدار: 2025-12-11	GPT-5.5 GPT-5.5 low الإصدار: 2026-04-24
النتيجة	8.5	9.3
الترتيب	#19	#4
الموثوقية	10.0	10.0
الاتساق	8.9	10.0
اختبارات صحيحة
معدل النجاح لكل محاولة	74.6%	85.7%
اختبارات غير مستقرة	3	0
إجمالي مرات التشغيل	63	63
التكلفة لكل نتيجة	2.803	5.035
إجمالي التكلفة	$0.393	$0.907
سعر الإدخال	$1.750 / 1M	$5.000 / 1M
سعر الإخراج	$14.000 / 1M	$30.000 / 1M
إجمالي رموز الإدخال	34,212	34,209
رموز الإخراج	23,744	2,046
رموز الاستدلال	0	22,460
زمن الاستجابة (المتوسط)	7.13s	9.76s
زمن الاستجابة (الحد الأقصى)	38.52s	56.19s
زمن الاستجابة (الإجمالي)	149.69s	204.92s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 GPT-5.2 Chat

none

التكلفة: $0.010
الوقت: 15.3s
الرموز: 797 tok

#4 GPT-5.5

low

التكلفة: $0.068
الوقت: 37.0s
الرموز: 2,339 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	606	1,807	0
GPT-5.5	10.0	10.0	100.0%	0		4.41s	606	238	1,020

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	8.8	7.8	88.9%	1		9.82s	7,305	6,731	0
GPT-5.5	10.0	10.0	100.0%	0		15.04s	7,302	423	6,402

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	11,019	1,243	0
GPT-5.5	10.0	10.0	100.0%	0		9.56s	11,019	303	717

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	7,140	980	0
GPT-5.5	10.0	10.0	100.0%	0		3.28s	7,140	228	157

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	723	7,810	0
GPT-5.5	5.3	10.0	33.3%	0		28.05s	723	69	11,609

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	477	335	0
GPT-5.5	10.0	10.0	100.0%	0		5.17s	477	133	245

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	9.8	10.0	100.0%	0		5.51s	660	1,441	0
GPT-5.5	9.9	10.0	100.0%	0		3.74s	660	93	415

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.10s	642	1,603	0
GPT-5.5	10.0	10.0	100.0%	0		4.74s	642	279	954

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	5,445	555	0
GPT-5.5	10.0	10.0	100.0%	0		4.96s	5,445	250	101

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	3.0	10.0	0.0%	0		6.89s	195	1,239	0
GPT-5.5	3.0	10.0	0.0%	0		10.06s	195	30	840

مقارنة سريعة

تبديل زوج المقارنة

Seed-2.0-LitemediumvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsStep 3.7 Flashmedium GPT-5.5lowvsQwen3.7 Maxmedium GPT-5.2 ChatnonevsGLM 5medium Claude Fable 5mediumvsGPT-5.5low Gemini 3.1 Pro PreviewmediumvsGPT-5.5low GPT-5.2 ChatnonevsGLM 5.2medium Gemini 3.5 FlashmediumvsGPT-5.5low DeepSeek V4 FlashhighvsGPT-5.2 Chatnone Claude Opus 4.7mediumvsGPT-5.2 Chatnone Gemini 2.5 FlashmediumvsGPT-5.2 Chatnone Gemini 3 Flash PreviewmediumvsGPT-5.5low