التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Z.ai: GLM 5.2

الملخص

مقارنة benchmark بين DeepSeek V3.2 و GLM 5.2: يتقدم DeepSeek V3.2 في متوسط النتيجة بـ 7.5 مقابل 7.1. لدى DeepSeek V3.2 تكلفة benchmark أقل عند $0.044 مقابل $0.076. GLM 5.2 أسرع عند 6.34s مقابل 68.71s، مع معدلات نجاح 65.1% مقابل 60.3%.

النموذج الموصى به: GLM 5.2 - Its score stays close to the best score here (7.1 vs 7.5), while responding about 10.8x faster than DeepSeek V3.2.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-17

المقياس DeepSeek V3.2 DeepSeek V3.2 medium الإصدار: 2025-12-01 GLM 5.2 GLM 5.2 none الإصدار: 2026-06-17
النتيجة 7.5 7.1
الترتيب #48 #61
الموثوقية 10.0 9.9
الاتساق 7.6 9.6
اختبارات صحيحة
معدل النجاح لكل محاولة 65.1% 60.3%
اختبارات غير مستقرة 6 1
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.436 0.628
إجمالي التكلفة $0.044 $0.076
سعر الإدخال $0.229 / 1M $1.400 / 1M
سعر الإخراج $0.344 / 1M $4.400 / 1M
إجمالي رموز الإدخال 38,333 38,671
رموز الإخراج 7,186 4,817
رموز الاستدلال 99,081 0
زمن الاستجابة (المتوسط) 68.71s 6.34s
زمن الاستجابة (الحد الأقصى) 376.10s 20.69s
زمن الاستجابة (الإجمالي) 1442.81s 133.19s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 DeepSeek V3.2

medium
Cost
$0.001
Time
53.6s
Tokens
1,932 tok

#61 GLM 5.2

none
Invalid SVG
Cost
$0.033
Time
87.7s
Tokens
7,455 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 8.2 7.9 83.3% 1 24.23s 448 3,247 6,953
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 14,283 571 6,296
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 7,388 207 7,693
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 2.9 4.4 22.2% 2 24.27s 472 21 6,838
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 3.4 2.5 33.3% 1 58.29s 314 49 2,189
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 627 1,397 2,845
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 7.0 7.2 55.6% 1 37.69s 594 518 6,375
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 8,307 507 859
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V3.2 3.0 10.0 0.0% 0 83.99s 183 20 7,019
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

مقارنة سريعة

تبديل زوج المقارنة