التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Mistral: Mistral Small 4 vs Qwen: Qwen3.6 Flash

الملخص

مقارنة benchmark بين Mistral Small 4 و Qwen3.6 Flash: يتقدم Qwen3.6 Flash في متوسط النتيجة بـ 5.4 مقابل 5.3. لدى Qwen3.6 Flash تكلفة benchmark أقل عند $0.015 مقابل $0.068. Qwen3.6 Flash أسرع عند 1.60s مقابل 9.40s، مع معدلات نجاح 44.4% مقابل 33.3%.

النموذج الموصى به: Qwen3.6 Flash - It has the best score here (5.4), while costing about 4.7x less than Mistral Small 4.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-10

المقياس Mistral Small 4 Mistral Small 4 medium الإصدار: 2026-03-16 Qwen3.6 Flash Qwen3.6 Flash none الإصدار: 2026-04-20
النتيجة 5.3 5.4
الترتيب #133 #129
الموثوقية 10.0 10.0
الاتساق 6.9 10.0
اختبارات صحيحة
معدل النجاح لكل محاولة 44.4% 33.3%
اختبارات غير مستقرة 8 0
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 1.344 0.266
إجمالي التكلفة $0.068 $0.015
سعر الإدخال $0.150 / 1M $0.188 / 1M
سعر الإخراج $0.600 / 1M $1.125 / 1M
إجمالي رموز الإدخال 42,576 50,810
رموز الإخراج 24,184 4,164
رموز الاستدلال 84,678 0
زمن الاستجابة (المتوسط) 9.40s 1.60s
زمن الاستجابة (الحد الأقصى) 59.15s 4.60s
زمن الاستجابة (الإجمالي) 197.39s 33.59s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 Mistral Small 4

medium
Cost
$0.006
Time
47.9s
Tokens
9,857 tok

#129 Qwen3.6 Flash

none
Cost
$0.005
Time
20.1s
Tokens
4,211 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 708 4,055 4,778
Qwen3.6 Flash 3.1 10.0 0.0% 0 1.63s 696 1,554 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Qwen3.6 Flash 5.4 10.0 33.3% 0 1.79s 6,488 889 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 18,706 2,612 10,700
Qwen3.6 Flash 3.0 10.0 0.0% 0 4.22s 24,675 315 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 6,171 335 723
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.13s 7,794 243 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 742 2,621 6,904
Qwen3.6 Flash 5.3 10.0 33.3% 0 1.11s 789 15 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 519 821 828
Qwen3.6 Flash 10.0 10.0 100.0% 0 947ms 522 132 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 729 540 1,031
Qwen3.6 Flash 6.3 10.0 50.0% 0 1.10s 711 66 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 3.4 9.7 0.0% 0 2.17s 735 1,226 2,632
Qwen3.6 Flash 3.5 10.0 0.0% 0 1.21s 714 669 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 6,420 321 810
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.49s 8,211 272 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 210 18 1,557
Qwen3.6 Flash 3.0 10.0 0.0% 0 649ms 210 9 0

مقارنة سريعة

تبديل زوج المقارنة