التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (medium) vs MiMo-V2.6-Pro

يتقدم MiMo-V2.6-Pro في متوسط النتيجة بـ 6.2 مقابل 6.1. لدى MiMo-V2.6-Pro تكلفة benchmark أقل عند $0.122 مقابل $0.756. MiMo-V2.6-Pro أسرع عند 7.09s مقابل 85.44s، مع معدلات نجاح 48.5% مقابل 45.5%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-09-21

النماذج المقارنة

الترتيب
#214
إجمالي رموز الإخراج
1,016,785
زمن الاستجابة (المتوسط)
85.44s
إجمالي التكلفة
$0.756
الترتيب
#202
إجمالي رموز الإخراج
80,341
زمن الاستجابة (المتوسط)
7.09s
إجمالي التكلفة
$0.122
النموذج الموصى به MiMo-V2.6-Pro

It has the best score here (6.2), while costing about 6.2x less than Trinity Large Thinking (medium).

مقارنة تفصيلية

المقياس Trinity Large Thinking Trinity Large Thinking medium الإصدار: 2026-07-28 MiMo-V2.6-Pro MiMo-V2.6-Pro none الإصدار: 2026-09-22
النتيجة 6.1 6.2
الترتيب #214 #202
الموثوقية 10.0 10.0
الاتساق 7.9 9.2
محاولات 66/66 66/66
اختبارات صحيحة
معدل النجاح لكل محاولة 48.5% 45.5%
اختبارات غير مستقرة 6 2
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 9.972 1.353
إجمالي التكلفة $0.756 $0.122
سعر الإدخال $0.250 / 1M $0.435 / 1M
سعر الإخراج $0.800 / 1M $0.870 / 1M
إجمالي رموز الإدخال 118,486 119,156
رموز الإخراج 156,166 80,341
رموز الاستدلال 860,619 0
زمن الاستجابة (المتوسط) 85.44s 7.09s
زمن الاستجابة (الحد الأقصى) 525.14s 106.86s
زمن الاستجابة (الإجمالي) 1879.75s 155.92s
المعلمات 398B الإجمالي (13B النشطة) 1.02T الإجمالي (42B النشطة)
الإتاحة الأوزان متاحة مفتوح المصدر

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#214 Trinity Large Thinking

medium
التكلفة
$0.016
الوقت
75.9s
الرموز
19,401 tok

#202 MiMo-V2.6-Pro

none
التكلفة
$0.002
الوقت
14.8s
الرموز
2,260 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
MiMo-V2.6-Pro 5.6 9.9 33.3% 0 3.69s 7,440 4,344 0

مقارنة سريعة

تبديل زوج المقارنة