التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 (high) vs Qwen3.8 27B (low)

يتقدم Qwen3.8 27B (low) في متوسط النتيجة بـ 7.6 مقابل 7.5. لدى Qwen3.8 27B (low) تكلفة benchmark أقل عند ~$0.089 مقابل $1.391. Qwen3.8 27B (low) أسرع عند 46.60s مقابل 263.69s، مع معدلات نجاح 65.2% مقابل 68.1%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-06

النماذج المقارنة

الترتيب
#126
إجمالي رموز الإخراج
590,306
زمن الاستجابة (المتوسط)
263.69s
إجمالي التكلفة
$1.391
الترتيب
#122
إجمالي رموز الإخراج
209,143
زمن الاستجابة (المتوسط)
46.60s
إجمالي التكلفة
~$0.089
النموذج الموصى به Qwen3.8 27B (low)

It has the best score here (7.6), while costing about 15.7x less than Mistral Large 4 (high).

مقارنة تفصيلية

المقياس Mistral Large 4 Mistral Large 4 high الإصدار: 2026-10-06 Qwen3.8 27B Qwen3.8 27B low الإصدار: 2026-08-14 متاح مجانًا
النتيجة 7.5 7.6
الترتيب #126 #122
الموثوقية 9.0 10.0
الاتساق 7.9 9.7
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 65.2% 68.1%
اختبارات غير مستقرة 6 1
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 11.590 ~0.589
إجمالي التكلفة $1.391 ~$0.089
سعر الإدخال $0.680 / 1M غير متاح
سعر الإخراج $2.090 / 1M غير متاح
سعر قراءة ذاكرة التخزين المؤقت $0.070 / 1M غير متاح
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح غير متاح
إجمالي رموز الإدخال 230,895 315,290
رموز الإخراج 161,281 1,607
رموز الاستدلال 510,655 207,536
زمن الاستجابة (المتوسط) 263.69s 46.60s
زمن الاستجابة (الحد الأقصى) 1727.29s 376.04s
زمن الاستجابة (الإجمالي) 6064.89s 1071.83s
المعلمات 1.05T الإجمالي (49B النشطة) 27.3B
الإتاحة مغلق المصدر الأوزان متاحة

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 Mistral Large 4

high
التكلفة
$0.007
الوقت
53.3s
الرموز
3,333 tok

#122 Qwen3.8 27B

low
التكلفة
~$0.003
الوقت
92.8s
الرموز
6,902 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694

مقارنة سريعة

تبديل زوج المقارنة

Seed-2.0-MinimediumvsMistral Large 4highQwen3.8 27Blowمتاح مجانًاvsSpace Bunny AlphahighQwen3.8 27Blowمتاح مجانًاvsGLM 5.1mediumMistral Large 4highvsGLM 5.1mediumSeed-2.0-MinimediumvsQwen3.8 27Blowمتاح مجانًاMistral Large 4highvsGPT-6 LunalowMistral Large 4highvsQwen3.8 Flash NextmediumMistral Large 4highvsGPT-5.6 LunamediumMistral Large 4highvsQwen3.6 FlashmediumDeepSeek V4 Flash 0731lowvsMistral Large 4highSeed-2.0-CodehighvsQwen3.8 27Blowمتاح مجانًاSeed-2.0-CodemediumvsMistral Large 4high