التنقل
Advertise here

Qwen3.8 Flash Next (xhigh) vs MiMo-V2.5 (medium)

متوسط النتيجة متقارب جدًا عند 7.1 مقابل 7.1. لدى MiMo-V2.5 (medium) تكلفة benchmark أقل عند $0.130 مقابل ~$0.195. MiMo-V2.5 (medium) أسرع عند 49.20s مقابل 102.66s، مع معدلات نجاح 72.5% مقابل 69.6%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-05

النماذج المقارنة

الترتيب
#154
إجمالي رموز الإخراج
621,056
زمن الاستجابة (المتوسط)
102.66s
إجمالي التكلفة
~$0.195
الترتيب
#157
إجمالي رموز الإخراج
341,511
زمن الاستجابة (المتوسط)
49.20s
إجمالي التكلفة
$0.130
النموذج الموصى به MiMo-V2.5 (medium)

It has the best score here (7.1), while costing about 1.5x less than Qwen3.8 Flash Next (xhigh).

مقارنة تفصيلية

المقياس Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh الإصدار: 2026-10-04 MiMo-V2.5 MiMo-V2.5 medium الإصدار: 2026-04-22
النتيجة 7.1 7.1
الترتيب #154 #157
الموثوقية 9.9 10.0
الاتساق 7.9 7.6
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 72.5% 69.6%
اختبارات غير مستقرة 6 7
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة ~1.390 3.491
إجمالي التكلفة ~$0.195 $0.130
سعر الإدخال غير متاح $0.140 / 1M
سعر الإخراج غير متاح $0.280 / 1M
سعر قراءة ذاكرة التخزين المؤقت غير متاح $0.003 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح غير متاح
إجمالي رموز الإدخال 301,749 259,664
رموز الإخراج 1,033 8,414
رموز الاستدلال 620,023 333,097
زمن الاستجابة (المتوسط) 102.66s 49.20s
زمن الاستجابة (الحد الأقصى) 674.08s 316.27s
زمن الاستجابة (الإجمالي) 2361.10s 1131.69s
المعلمات 180B الإجمالي (6B النشطة) 310B الإجمالي (15B النشطة)
الإتاحة الأوزان متاحة مفتوح المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#154 Qwen3.8 Flash Next

xhigh
التكلفة
~$0.010
الوقت
333.1s
الرموز
30,654 tok

#157 MiMo-V2.5

medium
التكلفة
$0.002
الوقت
54.8s
الرموز
5,247 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

مقارنة سريعة

تبديل زوج المقارنة

Qwen3.8 Flash NextxhighvsGLM 5.3 FlashXmediumGPT-5.2 ChatnonevsMiMo-V2.5mediumQwen3.8 Flash NextxhighvsMiMo-V2.6-FlashlowClaude Opus 5nonevsQwen3.8 Flash NextxhighQwen3.8 Flash NextxhighvsStep 3.7 FlashlowQwen3.8 Flash NextxhighvsGLM 5mediumLongCat 2.0mediumvsQwen3.8 Flash NextxhighEmber-1lowvsMiMo-V2.5mediumGPT-5.2 ChatnonevsQwen3.8 Flash NextxhighClaude Opus 5nonevsMiMo-V2.5mediumClaude Opus 4.8lowvsQwen3.8 Flash NextxhighGemini 3.1 Flash Lite PreviewmediumvsQwen3.8 Flash Nextxhigh