التنقل
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

يتقدم Qwen3.6 Max Preview (medium) في متوسط النتيجة بـ 8.4 مقابل 8.0. لدى GLM 5.2 (high) تكلفة benchmark أقل عند $0.296 مقابل $1.143. GLM 5.2 (high) أسرع عند 62.65s مقابل 67.53s، مع معدلات نجاح 80.3% مقابل 71.2%.

النموذج الموصى بهGLM 5.2 (high)Its score stays close to the best score here (8.0 vs 8.4), while costing about 3.9x less than Qwen3.6 Max Preview (medium).

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-18

المقياس Qwen3.6 Max Preview Qwen3.6 Max Preview medium الإصدار: 2026-04-20 GLM 5.2 GLM 5.2 high الإصدار: 2026-06-17
النتيجة 8.4 8.0
الترتيب #19 #31
الموثوقية 9.9 10.0
الاتساق 8.9 8.6
اختبارات صحيحة
معدل النجاح لكل محاولة 80.3% 71.2%
اختبارات غير مستقرة 3 3
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 8.173 5.873
إجمالي التكلفة $1.143 $0.296
سعر الإدخال $1.040 / 1M $0.293 / 1M
سعر الإخراج $6.240 / 1M $0.920 / 1M
إجمالي رموز الإدخال 79,240 83,813
رموز الإخراج 5,098 69,688
رموز الاستدلال 164,842 225,659
زمن الاستجابة (المتوسط) 67.53s 62.65s
زمن الاستجابة (الحد الأقصى) 238.07s 599.43s
زمن الاستجابة (الإجمالي) 1485.64s 1378.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 Qwen3.6 Max Preview

medium
التكلفة
$0.024
الوقت
76.5s
الرموز
3,861 tok

#31 GLM 5.2

high
SVG غير صالح
التكلفة
$0.000
الوقت
300.0s
الرموز
0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

مقارنة سريعة

تبديل زوج المقارنة