التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-4o-mini vs OpenAI: GPT-5.4

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-05

المقياس OpenAI: GPT-4o-mini none الإصدار: 2024-07-18 OpenAI: GPT-5.4 none الإصدار: 2026-03-05
الترتيب #46 #44
متوسط الدرجة 4.1 4.6
اختبارات صحيحة
الاتساق 10.0 8.9
التكلفة لكل نتيجة 0.111 1.496
إجمالي التكلفة $0.005 $0.090
معدل النجاح لكل محاولة 26.7% 44.4%
اختبارات غير مستقرة 0 2
common.totalAttempts 45 (15 x 3) 45 (15 x 3)
رموز الإخراج 1,528 1,635
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 2.21s 1.46s
زمن الاستجابة (الحد الأقصى) 7.58s 2.89s
زمن الاستجابة (الإجمالي) 17.69s 21.86s

أفضل النماذج حسب الدرجة

زمن الاستجابة (المتوسط)

الدرجة مقابل التكلفة الإجمالية

متوسط الدرجة vs زمن الاستجابة (المتوسط)

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-4o-mini 4.0 10.0 33.3% 0 1.83s 180 0
OpenAI: GPT-5.4 10.0 7.3 11.1% 1 1.41s 388 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-4o-mini 10.0 10.0 0.0% 0 7.58s 568 0
OpenAI: GPT-5.4 10.0 10.0 0.0% 0 2.89s 291 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-4o-mini 9.9 10.0 100.0% 0 1.27s 183 0
OpenAI: GPT-5.4 9.9 10.0 100.0% 0 1.04s 222 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-4o-mini 10.0 10.0 0.0% 0 637ms 15 0
OpenAI: GPT-5.4 4.0 7.2 44.4% 1 1.07s 50 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-4o-mini 4.5 10.0 0.0% 0 1.27s 69 0
OpenAI: GPT-5.4 5.5 10.0 50.0% 0 1.07s 81 0
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-4o-mini 2.3 10.0 0.0% 0 1.30s 308 0
OpenAI: GPT-5.4 4.0 9.8 33.3% 0 1.52s 357 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-4o-mini 10.0 10.0 100.0% 0 2.51s 205 0
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 2.75s 246 0

مقارنة سريعة

تبديل زوج المقارنة