التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs OpenAI: GPT-5.4

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-16

المقياس Gemini 3 Flash Preview Gemini 3 Flash Preview none الإصدار: 2025-12-17 GPT-5.4 GPT-5.4 medium الإصدار: 2026-03-05
النتيجة 8.1 8.2
الترتيب #21 #16
الاتساق 9.1 8.7
اختبارات صحيحة
معدل النجاح لكل محاولة 77.8% 79.6%
اختبارات غير مستقرة 2 3
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.156 6.399
إجمالي التكلفة $0.021 $0.832
??? ??????? $0.500 / 1M $2.500 / 1M
??? ??????? $3.000 / 1M $15.000 / 1M
رموز الإخراج 1,840 2,169
رموز الاستدلال 0 48,732
زمن الاستجابة (المتوسط) 1.65s 18.63s
زمن الاستجابة (الحد الأقصى) 3.56s 100.41s
زمن الاستجابة (الإجمالي) 18.20s 335.26s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 8.3 10.0 75.0% 0 1.25s 214 0
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.59s 423 0
GPT-5.4 10.0 10.0 100.0% 0 13.03s 389 2,045
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 4.7 1.6 66.7% 1 3.56s 350 0
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.41s 279 0
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 963ms 18 0
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 104 0
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 6.4 5.8 66.7% 1 1.58s 74 0
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.06s 144 0
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 234 0
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031

مقارنة سريعة

تبديل زوج المقارنة