التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 2.5 Flash vs OpenAI: GPT-5.2

الملخص

مقارنة benchmark بين Gemini 2.5 Flash و GPT-5.2: يتقدم GPT-5.2 في متوسط النتيجة بـ 8.4 مقابل 8.2. لدى Gemini 2.5 Flash تكلفة benchmark أقل عند $0.379 مقابل $0.548. Gemini 2.5 Flash أسرع عند 15.49s مقابل 16.88s، مع معدلات نجاح 69.8% مقابل 71.4%.

النموذج الموصى به: Gemini 2.5 Flash - It offers the best overall trade-off: a competitive score (8.2), lower cost than GPT-5.2, and balanced response time.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-18

المقياس Gemini 2.5 Flash Gemini 2.5 Flash medium الإصدار: 2025-06-17 GPT-5.2 GPT-5.2 medium الإصدار: 2025-12-11
النتيجة 8.2 8.4
الترتيب #24 #22
الموثوقية 10.0 10.0
الاتساق 9.6 8.4
اختبارات صحيحة
معدل النجاح لكل محاولة 69.8% 71.4%
اختبارات غير مستقرة 1 4
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 2.701 4.209
إجمالي التكلفة $0.379 $0.548
سعر الإدخال $0.300 / 1M $1.750 / 1M
سعر الإخراج $2.500 / 1M $14.000 / 1M
إجمالي رموز الإدخال 34,476 33,967
رموز الإخراج 1,930 2,901
رموز الاستدلال 145,145 31,932
زمن الاستجابة (المتوسط) 15.49s 16.88s
زمن الاستجابة (الحد الأقصى) 95.48s 77.80s
زمن الاستجابة (الإجمالي) 325.39s 236.34s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#24 Gemini 2.5 Flash

medium
SVG غير صالح
التكلفة
$0.000
الوقت
274.0s
الرموز
0 tok

#22 GPT-5.2

medium
التكلفة
$0.047
الوقت
49.2s
الرموز
3,396 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 492 255 10,233
GPT-5.2 6.5 8.0 58.3% 1 7.81s 606 567 2,002
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 7.8 10.0 66.7% 0 41.01s 6,669 543 32,303
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 12,522 303 11,922
GPT-5.2 10.0 10.0 100.0% 0 14.06s 11,019 291 1,757
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 7,257 279 2,325
GPT-5.2 10.0 10.0 100.0% 0 3.15s 7,140 234 420
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 633 18 80,702
GPT-5.2 5.9 7.2 55.6% 1 77.80s 473 42 10,342
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 486 92 1,899
GPT-5.2 3.7 9.7 0.0% 0 4.32s 477 162 269
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 615 69 1,203
GPT-5.2 9.9 10.0 100.0% 0 3.12s 660 94 614
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.18s 558 126 2,499
GPT-5.2 7.5 7.3 77.8% 1 5.80s 642 735 924
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 5,088 234 1,140
GPT-5.2 4.7 1.6 66.7% 1 10.30s 5,453 239 469
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 3.0 10.0 0.0% 0 2.76s 156 11 919
GPT-5.2 3.0 10.0 0.0% 0 28.18s 195 26 3,223

مقارنة سريعة

تبديل زوج المقارنة