التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

Mistral: Mistral Small 4 vs OpenAI: GPT-5 Nano

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-17

المقياس Mistral Small 4 Mistral Small 4 none الإصدار: 2026-03-16 GPT-5 Nano GPT-5 Nano medium الإصدار: 2025-08-07
الترتيب #61 #43
النتيجة 5.3 6.2
الاتساق 9.5 6.7
التكلفة لكل نتيجة 0.108 0.864
إجمالي التكلفة $0.006 $0.061
اختبارات صحيحة
معدل النجاح لكل محاولة 33.3% 58.8%
اختبارات غير مستقرة 1 7
إجمالي مرات التشغيل 51 51
رموز الإخراج 1,624 4,500
رموز الاستدلال 0 143,296
زمن الاستجابة (المتوسط) 629ms 44.47s
زمن الاستجابة (الحد الأقصى) 1.72s 204.02s
زمن الاستجابة (الإجمالي) 10.70s 444.74s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 3.4 7.9 16.7% 1 395ms 182 0
GPT-5 Nano 6.5 7.9 58.3% 1 25.50s 1,221 21,184
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 3.0 10.0 0.0% 0 1.72s 496 0
GPT-5 Nano 10.0 10.0 100.0% 0 65.96s 578 17,984
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 10.0 10.0 100.0% 0 822ms 261 0
GPT-5 Nano 3.7 1.7 50.0% 2 21.42s 453 10,560
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 5.3 10.0 33.3% 0 367ms 28 0
GPT-5 Nano 5.2 4.4 55.6% 2 204.02s 237 64,448
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 4.0 10.0 0.0% 0 729ms 205 0
GPT-5 Nano 4.1 10.0 0.0% 0 17.51s 202 4,608
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 6.5 10.0 50.0% 0 380ms 69 0
GPT-5 Nano 8.5 6.8 83.3% 1 11.90s 382 4,096
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 3.1 9.9 0.0% 0 589ms 170 0
GPT-5 Nano 5.3 7.2 44.4% 1 19.81s 869 13,440
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mistral Small 4 10.0 10.0 100.0% 0 1.40s 213 0
GPT-5 Nano 10.0 10.0 100.0% 0 33.30s 558 6,976

مقارنة سريعة

تبديل زوج المقارنة