التنقل
AI BENCHY
Advertise here

Qwen3.8 27B (low) vs GLM 5 (medium)

يتقدم Qwen3.8 27B (low) في متوسط النتيجة بـ 7.9 مقابل 7.7. لدى Qwen3.8 27B (low) تكلفة benchmark أقل عند ~$0.071 مقابل $0.228. GLM 5 (medium) أسرع عند 33.54s مقابل 39.11s، مع معدلات نجاح 68.2% مقابل 78.8%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-08-20

الترتيب
#61
إجمالي رموز الإخراج
169,329
زمن الاستجابة (المتوسط)
39.11s
إجمالي التكلفة
~$0.071
الترتيب
#72
إجمالي رموز الإخراج
124,566
زمن الاستجابة (المتوسط)
33.54s
إجمالي التكلفة
$0.228
النموذج الموصى به Qwen3.8 27B (low)

It has the best score here (7.9), while costing about 3.2x less than GLM 5 (medium).

مقارنة تفصيلية

المقياس Qwen3.8 27B Qwen3.8 27B low الإصدار: 2026-08-14 GLM 5 GLM 5 medium الإصدار: 2026-02-12
النتيجة 7.9 7.7
الترتيب #61 #72
الموثوقية 10.0 10.0
الاتساق 10.0 8.1
محاولات 66/66 63/66
اختبارات صحيحة
معدل النجاح لكل محاولة 68.2% 78.8%
اختبارات غير مستقرة 0 4
إجمالي مرات التشغيل 66 63
التكلفة لكل نتيجة ~0.473 1.668
إجمالي التكلفة ~$0.071 $0.228
سعر الإدخال غير متاح $0.600 / 1M
سعر الإخراج غير متاح $1.920 / 1M
إجمالي رموز الإدخال 99,705 35,224
رموز الإخراج 1,545 21,570
رموز الاستدلال 167,784 102,996
زمن الاستجابة (المتوسط) 39.11s 33.54s
زمن الاستجابة (الحد الأقصى) 376.04s 99.85s
زمن الاستجابة (الإجمالي) 860.51s 435.99s
المعلمات 27.3B 744B الإجمالي (40B النشطة)
الإتاحة الأوزان متاحة مفتوح المصدر

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 Qwen3.8 27B

low
التكلفة
~$0.003
الوقت
92.8s
الرموز
6,902 tok

#72 GLM 5

medium
التكلفة
$0.005
الوقت
20.7s
الرموز
2,068 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

مقارنة سريعة

تبديل زوج المقارنة

Seed-2.0-CodelowvsGLM 5mediumQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowQwen3.7 FlashhighvsGLM 5mediumClaude Opus 4.8lowvsGLM 5mediumGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumDeepSeek V4 ProhighvsGLM 5mediumGPT-5.6 TerramediumvsQwen3.8 27Blow