التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.7 Plus vs Z.ai: GLM 5.1

الملخص

مقارنة benchmark بين Qwen3.7 Plus و GLM 5.1: يتقدم Qwen3.7 Plus في متوسط النتيجة بـ 7.2 مقابل 7.1. لدى Qwen3.7 Plus تكلفة benchmark أقل عند $0.023 مقابل $0.292. Qwen3.7 Plus أسرع عند 2.85s مقابل 33.67s، مع معدلات نجاح 47.6% مقابل 68.3%.

النموذج الموصى به: Qwen3.7 Plus - It has the best score here (7.2), while costing about 13.2x less than GLM 5.1.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-12

المقياس Qwen3.7 Plus Qwen3.7 Plus none الإصدار: 2026-06-03 GLM 5.1 GLM 5.1 medium الإصدار: 2026-04-07
النتيجة 7.2 7.1
الترتيب #61 #64
الموثوقية 10.0 6.7
الاتساق 10.0 8.3
اختبارات صحيحة
معدل النجاح لكل محاولة 47.6% 68.3%
اختبارات غير مستقرة 0 4
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.276 2.496
إجمالي التكلفة $0.023 $0.292
سعر الإدخال $0.320 / 1M $0.980 / 1M
سعر الإخراج $1.280 / 1M $3.080 / 1M
إجمالي رموز الإدخال 42,510 32,995
رموز الإخراج 6,578 11,655
رموز الاستدلال 0 75,421
زمن الاستجابة (المتوسط) 2.85s 33.67s
زمن الاستجابة (الحد الأقصى) 29.38s 172.60s
زمن الاستجابة (الإجمالي) 59.86s 673.41s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 Qwen3.7 Plus

none
Cost
$0.019
Time
213.5s
Tokens
11,960 tok

#64 GLM 5.1

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 6.5 10.0 50.0% 0 1.38s 696 349 0
GLM 5.1 10.0 10.0 100.0% 0 8.31s 555 401 5,122
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 10.0 10.0 100.0% 0 29.38s 14,952 4,505 0
GLM 5.1 9.5 10.0 100.0% 0 43.11s 17,298 327 4,206
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 10.0 10.0 100.0% 0 1.43s 7,794 243 0
GLM 5.1 10.0 10.0 100.0% 0 9.33s 7,107 991 4,552
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 3.0 10.0 0.0% 0 868ms 789 18 0
GLM 5.1 5.3 10.0 33.3% 0 29.77s 489 969 11,314
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 5.3 10.0 0.0% 0 1.33s 522 78 0
GLM 5.1 10.0 10.0 100.0% 0 20.95s 477 2,875 2,875
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 6.3 10.0 50.0% 0 929ms 711 72 0
GLM 5.1 6.4 5.8 66.7% 1 7.47s 634 204 1,617
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 7.7 10.0 66.7% 0 1.71s 714 443 0
GLM 5.1 8.2 7.2 88.9% 1 31.64s 609 935 5,730
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 10.0 10.0 100.0% 0 3.54s 8,211 222 0
GLM 5.1 3.0 10.0 0.0% 0 0ms 0 0 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.7 Plus 3.0 10.0 0.0% 0 1.21s 210 9 0
GLM 5.1 3.0 10.0 0.0% 0 29.40s 124 82 2,179

مقارنة سريعة

تبديل زوج المقارنة