AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs Z.ai: GLM 5 Turbo

الملخص

مقارنة benchmark بين GPT-5.2 Chat و GLM 5 Turbo: يتقدم GPT-5.2 Chat في متوسط النتيجة بـ 8.5 مقابل 8.4. لدى GLM 5 Turbo تكلفة benchmark أقل عند $0.323 مقابل $0.393. GPT-5.2 Chat أسرع عند 7.13s مقابل 23.00s، مع معدلات نجاح 74.6% مقابل 74.6%.

النموذج الموصى به: GPT-5.2 Chat - It has the best score here (8.5), while responding about 3.2x faster than GLM 5 Turbo.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-12

المقياس	GPT-5.2 Chat GPT-5.2 Chat none الإصدار: 2025-12-11	GLM 5 Turbo GLM 5 Turbo medium الإصدار: 2026-03-15

المقياس	GPT-5.2 Chat GPT-5.2 Chat none الإصدار: 2025-12-11	GLM 5 Turbo GLM 5 Turbo medium الإصدار: 2026-03-15
النتيجة	8.5	8.4
الترتيب	#22	#24
الموثوقية	10.0	10.0
الاتساق	8.9	8.5
اختبارات صحيحة
معدل النجاح لكل محاولة	74.6%	74.6%
اختبارات غير مستقرة	3	4
إجمالي مرات التشغيل	63	63
التكلفة لكل نتيجة	2.803	2.011
إجمالي التكلفة	$0.393	$0.323
سعر الإدخال	$1.750 / 1M	$1.200 / 1M
سعر الإخراج	$14.000 / 1M	$4.000 / 1M
إجمالي رموز الإدخال	34,212	35,593
رموز الإخراج	23,744	12,245
رموز الاستدلال	0	62,277
زمن الاستجابة (المتوسط)	7.13s	23.00s
زمن الاستجابة (الحد الأقصى)	38.52s	194.23s
زمن الاستجابة (الإجمالي)	149.69s	482.97s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 GPT-5.2 Chat

none

Cost: $0.010
Time: 15.3s
Tokens: 797 tok

#24 GLM 5 Turbo

medium

Cost: $0.074
Time: 206.0s
Tokens: 18,549 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	606	1,807	0
GLM 5 Turbo	10.0	10.0	100.0%	0		4.82s	555	362	3,137

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	8.8	7.8	88.9%	1		9.82s	7,305	6,731	0
GLM 5 Turbo	8.2	9.3	66.7%	0		45.90s	5,941	363	25,381

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	11,019	1,243	0
GLM 5 Turbo	10.0	10.0	100.0%	0		13.88s	12,714	390	2,037

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	7,140	980	0
GLM 5 Turbo	10.0	10.0	100.0%	0		6.19s	7,107	577	3,632

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	723	7,810	0
GLM 5 Turbo	2.9	4.4	22.2%	2		71.07s	489	9,665	19,279

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	477	335	0
GLM 5 Turbo	6.1	3.1	66.7%	1		10.05s	477	60	2,216

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	9.8	10.0	100.0%	0		5.51s	660	1,441	0
GLM 5 Turbo	10.0	10.0	100.0%	0		5.38s	636	255	2,183

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.10s	642	1,603	0
GLM 5 Turbo	8.7	7.9	77.8%	1		5.23s	609	312	2,647

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	5,445	555	0
GLM 5 Turbo	10.0	10.0	100.0%	0		9.84s	6,879	241	446

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.2 Chat	3.0	10.0	0.0%	0		6.89s	195	1,239	0
GLM 5 Turbo	3.0	10.0	0.0%	0		40.17s	186	20	1,319

مقارنة سريعة

تبديل زوج المقارنة

Seed-2.0-LitemediumvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsStep 3.7 Flashmedium GPT-5.2 ChatnonevsGLM 5medium DeepSeek V4 FlashhighvsGLM 5 Turbomedium DeepSeek V4 FlashhighvsGPT-5.2 Chatnone Claude Opus 4.7mediumvsGPT-5.2 Chatnone Gemini 2.5 FlashmediumvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsQwen3.7 Plusmedium Claude Opus 4.8mediumvsGPT-5.2 Chatnone Nemotron 3 Ultra 550b A55bmediumمتاح مجانًاvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsQwen3.6 Max Previewmedium GPT-5.2 ChatnonevsQwen3.5 Plus 2026-02-15medium