التنقل
AI BENCHY
Advertise here

Kwaipilot: KAT-Coder-Pro V2.5 vs Xiaomi: MiMo-V2.5-Pro

متوسط النتيجة متقارب جدًا عند 6.9 مقابل 6.9. لدى MiMo-V2.5-Pro (medium) تكلفة benchmark أقل عند $0.187 مقابل $0.467. KAT-Coder-Pro V2.5 (medium) أسرع عند 24.04s مقابل 33.92s، مع معدلات نجاح 63.6% مقابل 66.7%.

النموذج الموصى بهMiMo-V2.5-Pro (medium)It has the best score here (6.9), while costing about 2.5x less than KAT-Coder-Pro V2.5 (medium).

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-21

المقياس KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium الإصدار: 2026-07-14 MiMo-V2.5-Pro MiMo-V2.5-Pro medium الإصدار: 2026-04-22
النتيجة 6.9 6.9
الترتيب #85 #88
الموثوقية 10.0 10.0
الاتساق 7.4 8.2
اختبارات صحيحة
معدل النجاح لكل محاولة 63.6% 66.7%
اختبارات غير مستقرة 7 5
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 4.237 3.218
إجمالي التكلفة $0.467 $0.187
سعر الإدخال $0.740 / 1M $0.435 / 1M
سعر الإخراج $2.960 / 1M $0.870 / 1M
إجمالي رموز الإدخال 87,907 139,883
رموز الإخراج 7,213 15,521
رموز الاستدلال 128,251 130,992
زمن الاستجابة (المتوسط) 24.04s 33.92s
زمن الاستجابة (الحد الأقصى) 257.00s 197.54s
زمن الاستجابة (الإجمالي) 528.92s 746.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 KAT-Coder-Pro V2.5

medium
التكلفة
$0.009
الوقت
25.6s
الرموز
2,939 tok

#88 MiMo-V2.5-Pro

medium
SVG غير صالح
التكلفة
$0.000
الوقت
300.0s
الرموز
0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218

مقارنة سريعة

تبديل زوج المقارنة