التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-02-15 vs Xiaomi: MiMo-V2.5

الملخص

مقارنة benchmark بين Qwen3.5 Plus 2026-02-15 و MiMo-V2.5: يتقدم MiMo-V2.5 في متوسط النتيجة بـ 6.7 مقابل 5.8. لدى Qwen3.5 Plus 2026-02-15 تكلفة benchmark أقل عند $0.016 مقابل $0.063. Qwen3.5 Plus 2026-02-15 أسرع عند 2.31s مقابل 27.11s، مع معدلات نجاح 46.0% مقابل 69.8%.

النموذج الموصى به: Qwen3.5 Plus 2026-02-15 - It offers the best overall trade-off: a competitive score (5.8), lower cost than MiMo-V2.5, and balanced response time.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-18

المقياس Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none الإصدار: 2026-02-15 MiMo-V2.5 MiMo-V2.5 medium الإصدار: 2026-04-22
النتيجة 5.8 6.7
الترتيب #106 #76
الموثوقية 10.0 10.0
الاتساق 9.4 8.1
اختبارات صحيحة
معدل النجاح لكل محاولة 46.0% 69.8%
اختبارات غير مستقرة 2 5
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.204 2.966
إجمالي التكلفة $0.016 $0.063
سعر الإدخال $0.260 / 1M $0.140 / 1M
سعر الإخراج $1.560 / 1M $0.280 / 1M
إجمالي رموز الإدخال 45,864 41,838
رموز الإخراج 2,480 2,827
رموز الاستدلال 0 198,898
زمن الاستجابة (المتوسط) 2.31s 27.11s
زمن الاستجابة (الحد الأقصى) 6.65s 162.44s
زمن الاستجابة (الإجمالي) 34.63s 569.38s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Qwen3.5 Plus 2026-02-15

none
التكلفة
$0.012
الوقت
153.2s
الرموز
7,787 tok

#76 MiMo-V2.5

medium
التكلفة
$0.002
الوقت
54.8s
الرموز
5,247 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 4.8 10.0 25.0% 0 1.91s 696 517 0
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 4.3 7.9 11.1% 1 2.05s 7,913 473 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 6.65s 18,304 314 0
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.89s 7,794 243 0
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 1.17s 789 17 0
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 4.4 3.0 33.3% 1 2.26s 522 117 0
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.67s 711 72 0
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 7.7 10.0 66.7% 0 2.71s 714 494 0
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 3.33s 8,211 222 0
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 1.11s 210 11 0
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

مقارنة سريعة

تبديل زوج المقارنة