التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mercury 2.5 (medium) vs Kimi K2.5 (medium)

متوسط النتيجة متقارب جدًا عند 6.4 مقابل 6.4. لدى Mercury 2.5 (medium) تكلفة benchmark أقل عند $0.034 مقابل $0.841. Mercury 2.5 (medium) أسرع عند 7.74s مقابل 125.76s، مع معدلات نجاح 63.8% مقابل 60.9%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-03

النماذج المقارنة

الترتيب
#209
إجمالي رموز الإخراج
138,946
زمن الاستجابة (المتوسط)
7.74s
إجمالي التكلفة
$0.034
الترتيب
#208
إجمالي رموز الإخراج
241,096
زمن الاستجابة (المتوسط)
125.76s
إجمالي التكلفة
$0.841
النموذج الموصى به Mercury 2.5 (medium)

It has the best score here (6.4), while costing about 25.1x less than Kimi K2.5 (medium).

مقارنة تفصيلية

المقياس Mercury 2.5 Mercury 2.5 medium الإصدار: 2026-09-08 Kimi K2.5 Kimi K2.5 medium الإصدار: 2026-01-27
النتيجة 6.4 6.4
الترتيب #209 #208
الموثوقية 9.7 9.6
الاتساق 8.3 7.1
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 63.8% 60.9%
اختبارات غير مستقرة 5 8
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 0.280 6.085
إجمالي التكلفة $0.034 $0.841
سعر الإدخال $0.040 / 1M $0.450 / 1M
سعر الإخراج $0.150 / 1M $2.250 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.004 / 1M $0.070 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح غير متاح
إجمالي رموز الإدخال 317,982 292,271
رموز الإخراج 3,918 55,025
رموز الاستدلال 135,028 186,071
زمن الاستجابة (المتوسط) 7.74s 125.76s
زمن الاستجابة (الحد الأقصى) 107.89s 566.79s
زمن الاستجابة (الإجمالي) 178.07s 2137.84s
المعلمات ~100B 1T الإجمالي (32B النشطة)
الإتاحة مغلق المصدر الأوزان متاحة

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#209 Mercury 2.5

medium
التكلفة
$0.001
الوقت
3.8s
الرموز
3,386 tok

#208 MoonshotAI: Kimi K2.5

medium
التكلفة
$0.030
الوقت
58.6s
الرموز
8,683 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2.5 5.0 5.1 44.5% 2 3.70s 7,807 488 21,857
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693

مقارنة سريعة

تبديل زوج المقارنة