التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Xiaomi: MiMo-V2.5

الملخص

مقارنة benchmark بين DeepSeek V4 Pro و MiMo-V2.5: يتقدم MiMo-V2.5 في متوسط النتيجة بـ 6.7 مقابل 6.3. لدى MiMo-V2.5 تكلفة benchmark أقل عند $0.063 مقابل $0.079. MiMo-V2.5 أسرع عند 27.11s مقابل 65.21s، مع معدلات نجاح 52.4% مقابل 69.8%.

النموذج الموصى به: MiMo-V2.5 - It has the best score here (6.7), while responding about 2.4x faster than DeepSeek V4 Pro.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-12

المقياس DeepSeek V4 Pro DeepSeek V4 Pro high الإصدار: 2026-04-24 MiMo-V2.5 MiMo-V2.5 medium الإصدار: 2026-04-22
النتيجة 6.3 6.7
الترتيب #90 #76
الموثوقية 9.0 10.0
الاتساق 7.6 8.1
اختبارات صحيحة
معدل النجاح لكل محاولة 52.4% 69.8%
اختبارات غير مستقرة 6 5
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 2.869 2.966
إجمالي التكلفة $0.079 $0.063
سعر الإدخال $0.435 / 1M $0.140 / 1M
سعر الإخراج $0.870 / 1M $0.280 / 1M
إجمالي رموز الإدخال 32,240 41,838
رموز الإخراج 12,250 2,827
رموز الاستدلال 72,257 198,898
زمن الاستجابة (المتوسط) 65.21s 27.11s
زمن الاستجابة (الحد الأقصى) 358.35s 162.44s
زمن الاستجابة (الإجمالي) 1304.19s 569.38s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#90 DeepSeek V4 Pro

high
Cost
$0.023
Time
257.6s
Tokens
14,870 tok

#76 MiMo-V2.5

medium
Cost
$0.002
Time
54.8s
Tokens
5,247 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 6.4 7.9 58.3% 1 16.53s 448 71 3,617
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 3.3 6.4 11.1% 1 118.23s 1,966 111 20,940
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 10.0 10.0 100.0% 0 65.02s 14,016 465 5,914
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 7.3 5.9 83.3% 1 23.62s 5,633 229 1,710
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 2.9 7.2 11.1% 1 205.66s 430 10,529 28,089
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 6.1 3.1 66.7% 1 25.09s 314 76 1,152
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 10.0 10.0 100.0% 0 41.16s 627 205 2,416
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 5.9 7.2 55.6% 1 34.84s 544 139 4,019
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 10.0 10.0 100.0% 0 21.33s 8,079 372 593
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Pro 3.0 10.0 0.0% 0 39.14s 183 53 3,807
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

مقارنة سريعة

تبديل زوج المقارنة