التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: GPT-5.5

الملخص

مقارنة benchmark بين Gemini 3.5 Flash و GPT-5.5: يتقدم Gemini 3.5 Flash في متوسط النتيجة بـ 6.8 مقابل 6.3. لدى Gemini 3.5 Flash تكلفة benchmark أقل عند $0.108 مقابل $0.231. Gemini 3.5 Flash أسرع عند 1.57s مقابل 1.89s، مع معدلات نجاح 68.3% مقابل 54.0%.

النموذج الموصى به: Gemini 3.5 Flash - It has the best score here (6.8), while costing about 2.1x less than GPT-5.5.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-18

المقياس Gemini 3.5 Flash Gemini 3.5 Flash minimal الإصدار: 2026-05-19 GPT-5.5 GPT-5.5 none الإصدار: 2026-04-24
النتيجة 6.8 6.3
الترتيب #71 #90
الموثوقية 10.0 10.0
الاتساق 9.6 8.8
اختبارات صحيحة
معدل النجاح لكل محاولة 68.3% 54.0%
اختبارات غير مستقرة 1 3
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.767 2.302
إجمالي التكلفة $0.108 $0.231
سعر الإدخال $1.500 / 1M $5.000 / 1M
سعر الإخراج $9.000 / 1M $30.000 / 1M
إجمالي رموز الإدخال 39,847 34,212
رموز الإخراج 5,277 1,971
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 1.57s 1.89s
زمن الاستجابة (الحد الأقصى) 5.51s 5.56s
زمن الاستجابة (الإجمالي) 33.02s 39.64s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Gemini 3.5 Flash

minimal
التكلفة
$0.041
الوقت
20.4s
الرموز
4,608 tok

#90 GPT-5.5

none
التكلفة
$0.090
الوقت
54.3s
الرموز
3,063 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 6.5 10.0 50.0% 0 892ms 492 405 0
GPT-5.5 6.9 7.9 66.7% 1 1.31s 606 213 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 5.6 9.9 33.3% 0 2.75s 8,122 3,456 0
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 3.0 10.0 0.0% 0 3.56s 15,780 404 0
GPT-5.5 3.0 10.0 0.0% 0 5.56s 11,019 300 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.66s 7,548 279 0
GPT-5.5 10.0 10.0 100.0% 0 1.18s 7,140 222 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 899ms 633 12 0
GPT-5.5 2.9 7.2 11.1% 1 1.31s 723 52 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 922ms 486 117 0
GPT-5.5 10.0 10.0 100.0% 0 3.41s 477 124 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 6.4 5.8 66.7% 1 893ms 615 76 0
GPT-5.5 6.2 5.8 66.7% 1 1.15s 660 81 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.45s 558 282 0
GPT-5.5 7.7 10.0 66.7% 0 1.29s 642 252 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.79s 5,457 234 0
GPT-5.5 10.0 10.0 100.0% 0 3.90s 5,445 247 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 3.0 10.0 0.0% 0 1.76s 156 12 0
GPT-5.5 3.0 10.0 0.0% 0 5.01s 195 18 0

مقارنة سريعة

تبديل زوج المقارنة