التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 5 vs Z.ai: GLM 5.2

الملخص

مقارنة benchmark بين Claude Sonnet 5 و GLM 5.2: يتقدم Claude Sonnet 5 في متوسط النتيجة بـ 7.9 مقابل 7.1. لدى GLM 5.2 تكلفة benchmark أقل عند $0.051 مقابل $0.550. GLM 5.2 أسرع عند 6.34s مقابل 9.94s، مع معدلات نجاح 79.4% مقابل 60.3%.

النموذج الموصى به: GLM 5.2 - Its score stays close to the best score here (7.1 vs 7.9), while costing about 10.9x less than Claude Sonnet 5.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-30

المقياس Claude Sonnet 5 Claude Sonnet 5 medium الإصدار: 2026-06-30 GLM 5.2 GLM 5.2 none الإصدار: 2026-06-17
النتيجة 7.9 7.1
الترتيب #30 #63
الموثوقية 10.0 9.9
الاتساق 9.0 9.6
اختبارات صحيحة
معدل النجاح لكل محاولة 79.4% 60.3%
اختبارات غير مستقرة 3 1
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 3.662 0.628
إجمالي التكلفة $0.550 $0.051
سعر الإدخال $2.000 / 1M $0.930 / 1M
سعر الإخراج $10.000 / 1M $3.000 / 1M
إجمالي رموز الإدخال 67,416 38,671
رموز الإخراج 34,012 4,817
رموز الاستدلال 7,673 0
زمن الاستجابة (المتوسط) 9.94s 6.34s
زمن الاستجابة (الحد الأقصى) 56.94s 20.69s
زمن الاستجابة (الإجمالي) 208.71s 133.19s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 Claude Sonnet 5

medium
التكلفة
$0.007
الوقت
6.4s
الرموز
832 tok

#63 GLM 5.2

none
SVG غير صالح
التكلفة
$0.033
الوقت
87.7s
الرموز
7,455 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 10.0 10.0 100.0% 0 3.80s 834 1,220 446
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 4.5 2.1 66.7% 1 37.01s 29,394 4,848 2,170
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 10.0 10.0 100.0% 0 3.16s 10,503 312 0
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 7.7 10.0 66.7% 0 20.38s 975 12,140 1,994
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 4.8 3.2 33.3% 1 4.32s 708 264 0
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 9.9 10.0 100.0% 0 3.10s 909 318 269
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 7.7 10.0 66.7% 0 2.98s 894 407 121
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 10.0 10.0 100.0% 0 10.70s 12,351 433 90
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 5 3.0 10.0 0.0% 0 7.06s 258 917 204
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

مقارنة سريعة

تبديل زوج المقارنة