التنقل
AI BENCHY
Advertise here

Qwen: Qwen3.5-9B vs Z.ai: GLM 4.7 Flash

يتقدم GLM 4.7 Flash (medium) في متوسط النتيجة بـ 4.3 مقابل 3.8. لدى Qwen3.5-9B (medium) تكلفة benchmark أقل عند $0.036 مقابل $0.166. Qwen3.5-9B (medium) أسرع عند 82.24s مقابل 142.59s، مع معدلات نجاح 25.8% مقابل 31.8%.

النموذج الموصى بهGLM 4.7 Flash (medium)It has the strongest score in this comparison (4.3) and the best overall balance of cost and response time across all 2 models.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-25

المقياس Qwen3.5-9B Qwen3.5-9B medium الإصدار: 2026-03-02 GLM 4.7 Flash GLM 4.7 Flash medium الإصدار: 2026-01-19
النتيجة 3.8 4.3
الترتيب #220 #210
الموثوقية 5.0 7.8
الاتساق 8.1 7.0
اختبارات صحيحة
معدل النجاح لكل محاولة 25.8% 31.8%
اختبارات غير مستقرة 5 8
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 1.187 4.147
إجمالي التكلفة $0.036 $0.166
سعر الإدخال $0.100 / 1M $0.060 / 1M
سعر الإخراج $0.150 / 1M $0.400 / 1M
إجمالي رموز الإدخال 17,070 79,051
رموز الإخراج 29,045 43,754
رموز الاستدلال 209,516 374,109
زمن الاستجابة (المتوسط) 82.24s 142.59s
زمن الاستجابة (الحد الأقصى) 226.38s 1539.97s
زمن الاستجابة (الإجمالي) 1315.88s 1996.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 Qwen3.5-9B

medium
التكلفة
$0.001
الوقت
35.9s
الرموز
3,030 tok

#210 GLM 4.7 Flash

medium
SVG غير صالح
التكلفة
$0.000
الوقت
186.2s
الرموز
12,112 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387

مقارنة سريعة

تبديل زوج المقارنة