التنقل
AI BENCHY
Advertise here

النماذج المقارنة

مقارنة benchmark بين GLM 5 (medium) vs GLM 5.1 (medium) vs Kimi K2.5 (medium) vs Qwen3.6 Plus Preview (medium): يتصدر GLM 5 (medium) في النتيجة بقيمة 7.7. يتصدر GLM 5 (medium) في الموثوقية بقيمة 10.0. يمتلك Qwen3.6 Plus Preview (medium) أقل إجمالي التكلفة عند $0.000. Qwen3.6 Plus Preview (medium) هو الأسرع عند 15.25s.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-25

الترتيب
#49
إجمالي رموز الإخراج
124,566
زمن الاستجابة (المتوسط)
33.54s
إجمالي التكلفة
$0.307
الترتيب
#82
إجمالي رموز الإخراج
152,552
زمن الاستجابة (المتوسط)
46.77s
إجمالي التكلفة
$0.535
الترتيب
#85
إجمالي رموز الإخراج
227,367
زمن الاستجابة (المتوسط)
99.00s
إجمالي التكلفة
$0.600
الترتيب
#190
إجمالي رموز الإخراج
63,350
زمن الاستجابة (المتوسط)
15.25s
إجمالي التكلفة
$0.000
النموذج الموصى به GLM 5 (medium)

It has the best score here (7.7), while costing about 1.8x less than النماذج الأخرى في هذه المقارنة.

مقارنة تفصيلية

المقياس GLM 5 GLM 5 medium الإصدار: 2026-02-12 GLM 5.1 GLM 5.1 medium الإصدار: 2026-04-07 Kimi K2.5 Kimi K2.5 medium الإصدار: 2026-01-27 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium الإصدار: 2026-04-20 متاح مجانًا
النتيجة 7.7 7.1 7.0 4.9
الترتيب #49 #82 #85 #190
الموثوقية 10.0 8.3 10.0 غير متاح
الاتساق 8.1 8.4 7.0 8.6
اختبارات صحيحة
معدل النجاح لكل محاولة 78.8% 69.7% 65.2% 40.9%
اختبارات غير مستقرة 4 4 8 0
إجمالي مرات التشغيل 63 66 66 57
التكلفة لكل نتيجة 1.668 4.202 4.789 0.000
إجمالي التكلفة $0.307 $0.535 $0.600 $0.000
سعر الإدخال $0.950 / 1M $0.966 / 1M $0.571 / 1M $0.000 / 1M
سعر الإخراج $2.551 / 1M $3.036 / 1M $2.850 / 1M $0.000 / 1M
إجمالي رموز الإدخال 35,224 82,623 118,448 32,639
رموز الإخراج 21,570 16,089 62,124 1,153
رموز الاستدلال 102,996 136,463 165,243 62,197
زمن الاستجابة (المتوسط) 33.54s 46.77s 99.00s 15.25s
زمن الاستجابة (الحد الأقصى) 99.85s 308.75s 281.00s 43.55s
زمن الاستجابة (الإجمالي) 435.99s 982.16s 1485.04s 182.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 GLM 5

medium
التكلفة
$0.005
الوقت
20.7s
الرموز
2,068 tok

#82 GLM 5.1

medium
SVG غير صالح
التكلفة
$0.000
الوقت
300.0s
الرموز
0 tok

#85 MoonshotAI: Kimi K2.5

medium
التكلفة
$0.030
الوقت
58.6s
الرموز
8,683 tok

#190 Qwen3.6 Plus Preview

medium
لم يتم إنشاء نتيجة عرض لهذا النموذج بعد.
التكلفة
$0.000
الوقت
-
الرموز
0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Qwen3.6 Plus Preview 9.8 3.3 0.0% 0 0ms 0 0 0

مقارنة سريعة

تبديل زوج المقارنة