التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.4

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-22

المقياس Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium الإصدار: 2026-05-08 GPT-5.4 GPT-5.4 medium الإصدار: 2026-03-05
النتيجة 7.7 7.9
الترتيب #35 #27
الموثوقية 10.0 10.0
الاتساق 9.2 8.5
اختبارات صحيحة
معدل النجاح لكل محاولة 68.3% 75.0%
اختبارات غير مستقرة 2 4
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 0.500 8.767
إجمالي التكلفة $0.065 $1.140
??? ??????? $0.250 / 1M $2.500 / 1M
??? ??????? $1.500 / 1M $15.000 / 1M
رموز الإخراج 2,248 2,222
رموز الاستدلال 35,390 68,503
زمن الاستجابة (المتوسط) 3.18s 22.31s
زمن الاستجابة (الحد الأقصى) 10.87s 100.41s
زمن الاستجابة (الإجمالي) 63.55s 446.15s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 9.1 10.0 75.0% 0 2.39s 604 4,201
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 6.8 10.0 50.0% 0 3.59s 453 6,068
GPT-5.4 8.2 6.7 83.3% 1 54.98s 412 19,995
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 10.87s 327 7,401
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 279 2,845
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 3.16s 15 5,165
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 84 1,142
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 9.9 10.0 100.0% 0 2.59s 75 3,320
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 7.6 7.2 77.8% 1 1.95s 165 2,450
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.55s 234 921
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 3.08s 12 1,877
GPT-5.4 3.0 10.0 0.0% 0 13.95s 30 1,821

مقارنة سريعة

تبديل زوج المقارنة