التنقل
AI BENCHY
قارن الرسوم البيانية المنهجية
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs OpenAI: GPT-5.4

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-06

المقياس Google: Gemini 3 Flash Preview medium الإصدار: 2025-12-17 OpenAI: GPT-5.4 medium الإصدار: 2026-03-05
متوسط الدرجة 10.0 8.2
الترتيب #1 #7
اختبارات صحيحة
الاتساق 10.0 8.9
التكلفة لكل نتيجة 1.064 6.533
إجمالي التكلفة $0.160 $0.784
معدل النجاح لكل محاولة 100.0% 86.7%
اختبارات غير مستقرة 0 2
common.totalRuns 45 (15 x 3) 45 (15 x 3)
رموز الإخراج 1,523 1,611
رموز الاستدلال 46,622 46,321
زمن الاستجابة (المتوسط) 13.39s 21.06s
زمن الاستجابة (الحد الأقصى) 50.16s 100.41s
زمن الاستجابة (الإجمالي) 107.12s 315.95s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

متوسط الدرجة vs زمن الاستجابة (المتوسط)

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.61s 299 3,127
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 5.02s 216 1,466
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 50.16s 351 12,645
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 9.9 10.0 100.0% 0 4.72s 279 5,333
OpenAI: GPT-5.4 9.9 10.0 100.0% 0 5.32s 234 804
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 21.12s 12 14,908
OpenAI: GPT-5.4 4.0 7.2 44.4% 1 74.27s 61 34,748
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.10s 72 4,558
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.43s 276 4,921
OpenAI: GPT-5.4 7.0 7.2 88.9% 1 9.13s 442 3,832
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 10.55s 234 1,130
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031

مقارنة سريعة

تبديل زوج المقارنة