التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs OpenAI: GPT-5.4 Mini

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-01

المقياس Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none الإصدار: 2026-03-03 GPT-5.4 Mini GPT-5.4 Mini medium الإصدار: 2026-03-17
النتيجة 7.9 7.3
الترتيب #40 #58
الموثوقية غير متاح غير متاح
الاتساق 9.6 7.4
اختبارات صحيحة
معدل النجاح لكل محاولة 70.4% 70.4%
اختبارات غير مستقرة 1 6
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.130 3.313
إجمالي التكلفة $0.016 $0.299
??? ??????? $0.250 / 1M $0.750 / 1M
??? ??????? $1.500 / 1M $4.500 / 1M
رموز الإخراج 5,361 2,131
رموز الاستدلال 0 59,567
زمن الاستجابة (المتوسط) 1.30s 15.22s
زمن الاستجابة (الحد الأقصى) 3.39s 102.91s
زمن الاستجابة (الإجمالي) 23.42s 273.90s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 7.5 8.4 66.7% 1 1.04s 1,092 0
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 296 2,876
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.47s 640 0
GPT-5.4 Mini 10.0 10.0 100.0% 0 7.76s 423 1,548
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 3.20s 339 0
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 317 4,317
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.22s 399 0
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 234 650
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 942ms 568 0
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 60 43,286
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 741ms 69 0
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 150 510
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.13s 574 0
GPT-5.4 Mini 7.4 6.7 66.7% 1 2.50s 129 1,337
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 972ms 898 0
GPT-5.4 Mini 6.8 7.9 55.6% 1 4.33s 271 2,449
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.39s 782 0
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 251 2,594

مقارنة سريعة

تبديل زوج المقارنة