AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs Qwen: Qwen3.5 Plus 2026-04-20

الملخص

مقارنة benchmark بين GPT-5.2 Chat و Qwen3.5 Plus 2026-04-20: يتقدم GPT-5.2 Chat في متوسط النتيجة بـ 7.9 مقابل 7.6. لدى Qwen3.5 Plus 2026-04-20 تكلفة benchmark أقل عند $0.317 مقابل $0.393. GPT-5.2 Chat أسرع عند 7.13s مقابل 46.36s، مع معدلات نجاح 74.6% مقابل 66.7%.

النموذج الموصى به: GPT-5.2 Chat - It has the best score here (7.9), while responding about 6.5x faster than Qwen3.5 Plus 2026-04-20.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-10

المقياس	GPT-5.2 Chat GPT-5.2 Chat none الإصدار: 2025-12-11	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium الإصدار: 2026-04-20

المقياس	GPT-5.2 Chat GPT-5.2 Chat none الإصدار: 2025-12-11	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium الإصدار: 2026-04-20
النتيجة	7.9	7.6
الترتيب	#25	#37
الموثوقية	10.0	10.0
الاتساق	8.9	9.0
اختبارات صحيحة
معدل النجاح لكل محاولة	74.6%	66.7%
اختبارات غير مستقرة	3	2
إجمالي مرات التشغيل	63	63
التكلفة لكل نتيجة	2.803	3.023
إجمالي التكلفة	$0.393	$0.317
سعر الإدخال	$1.750 / 1M	$0.300 / 1M
سعر الإخراج	$14.000 / 1M	$1.800 / 1M
إجمالي رموز الإدخال	34,212	42,097
رموز الإخراج	23,744	2,280
رموز الاستدلال	0	166,613
زمن الاستجابة (المتوسط)	7.13s	46.36s
زمن الاستجابة (الحد الأقصى)	38.52s	189.38s
زمن الاستجابة (الإجمالي)	149.69s	973.57s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 GPT-5.2 Chat

none

Cost: $0.010
Time: 15.3s
Tokens: 797 tok

#37 Qwen3.5 Plus 2026-04-20

medium

Cost: $0.008
Time: 76.7s
Tokens: 4,355 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	606	1,807	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		10.84s	672	215	7,748

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	8.8	7.8	88.9%	1		9.82s	7,305	6,731	0
Qwen3.5 Plus 2026-04-20	6.2	8.7	33.3%	0		125.25s	7,630	308	58,682

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	11,019	1,243	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		92.41s	14,934	483	17,490

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	7,140	980	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		38.32s	7,782	270	14,668

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	723	7,810	0
Qwen3.5 Plus 2026-04-20	2.9	7.2	11.1%	1		53.10s	771	63	28,414

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	477	335	0
Qwen3.5 Plus 2026-04-20	4.9	9.6	0.0%	0		25.30s	516	125	4,792

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	9.8	10.0	100.0%	0		5.51s	660	1,441	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		20.25s	699	103	7,689

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.10s	642	1,603	0
Qwen3.5 Plus 2026-04-20	8.2	7.2	88.9%	1		17.67s	696	338	9,800

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	5,445	555	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		14.72s	8,193	348	2,164

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	3.0	10.0	0.0%	0		6.89s	195	1,239	0
Qwen3.5 Plus 2026-04-20	3.0	10.0	0.0%	0		92.57s	204	27	15,166

مقارنة سريعة

تبديل زوج المقارنة

GPT-5.2 ChatnonevsQwen3.5 Plus 2026-02-15medium GPT-5.2 ChatnonevsGLM 5 Turbomedium GPT-5.2 ChatnonevsStep 3.7 Flashmedium GPT-5.2 ChatnonevsQwen3.6 Plusmedium Gemini 3.5 FlashminimalvsQwen3.5 Plus 2026-04-20medium Gemma 4 31Bmediumمتاح مجانًاvsGPT-5.2 Chatnone Gemini 2.5 FlashmediumvsGPT-5.2 Chatnone DeepSeek V4 FlashhighvsQwen3.5 Plus 2026-04-20medium GPT-5.2 ChatnonevsQwen3.5-122B-A10Bmedium GPT-5.2 ChatnonevsQwen3.5-27Bmedium DeepSeek V4 FlashhighvsGPT-5.2 Chatnone Gemini 3 Flash PreviewnonevsQwen3.5 Plus 2026-04-20medium