التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Z.ai: GLM 5V Turbo

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-28

المقياس Claude Opus 4.8 Claude Opus 4.8 none الإصدار: 2026-05-28 GLM 5V Turbo GLM 5V Turbo medium الإصدار: 2026-04-01
النتيجة 7.3 7.4
الترتيب #63 #60
الموثوقية 10.0 10.0
الاتساق 9.2 8.2
اختبارات صحيحة
معدل النجاح لكل محاولة 65.0% 68.3%
اختبارات غير مستقرة 2 5
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 4.324 3.695
إجمالي التكلفة $0.519 $0.407
سعر الإدخال $5.000 / 1M $1.200 / 1M
سعر الإخراج $25.000 / 1M $4.000 / 1M
رموز الإخراج 8,098 2,334
رموز الاستدلال 0 86,653
زمن الاستجابة (المتوسط) 3.51s 20.21s
زمن الاستجابة (الحد الأقصى) 17.73s 95.88s
زمن الاستجابة (الإجمالي) 70.19s 404.14s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 1,472 0
GLM 5V Turbo 7.2 6.1 75.0% 2 10.76s 587 7,872
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 6.8 10.0 50.0% 0 3.59s 1,323 0
GLM 5V Turbo 6.8 10.0 50.0% 0 54.83s 427 26,111
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 3,259 0
GLM 5V Turbo 6.9 3.8 66.7% 1 15.06s 403 2,523
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 308 0
GLM 5V Turbo 10.0 10.0 100.0% 0 9.60s 236 4,333
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 61 0
GLM 5V Turbo 5.3 7.2 44.4% 1 38.15s 32 29,035
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 230 0
GLM 5V Turbo 10.0 10.0 100.0% 0 11.09s 131 2,183
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 95 0
GLM 5V Turbo 9.9 10.0 100.0% 0 3.74s 72 1,813
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 783 0
GLM 5V Turbo 7.7 10.0 66.7% 0 10.24s 131 4,496
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 355 0
GLM 5V Turbo 7.0 3.7 66.7% 1 12.53s 293 765
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 212 0
GLM 5V Turbo 3.0 10.0 0.0% 0 40.96s 22 7,522

مقارنة سريعة

تبديل زوج المقارنة