التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.2

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-22

المقياس Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high الإصدار: 2026-05-08 GPT-5.2 GPT-5.2 medium الإصدار: 2025-12-11
النتيجة 7.5 7.4
الترتيب #48 #57
الموثوقية 9.8 10.0
الاتساق 8.1 8.3
اختبارات صحيحة
معدل النجاح لكل محاولة 74.1% 70.0%
اختبارات غير مستقرة 4 4
إجمالي مرات التشغيل 54 60
التكلفة لكل نتيجة 18.579 4.081
إجمالي التكلفة $2.044 $0.490
??? ??????? $0.250 / 1M $1.750 / 1M
??? ??????? $1.500 / 1M $14.000 / 1M
رموز الإخراج 1,984 2,754
رموز الاستدلال 1,355,583 28,303
زمن الاستجابة (المتوسط) 61.96s 16.44s
زمن الاستجابة (الحد الأقصى) 149.23s 77.80s
زمن الاستجابة (الإجمالي) 1115.31s 213.77s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 9.4 10.0 100.0% 0 37.16s 100 130,598
GPT-5.2 6.5 8.0 58.3% 1 7.81s 567 2,002
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 137.63s 666 188,733
GPT-5.2 10.0 10.0 100.0% 0 23.15s 490 8,269
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 149.23s 327 198,243
GPT-5.2 10.0 10.0 100.0% 0 14.06s 291 1,757
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.49s 279 7,351
GPT-5.2 10.0 10.0 100.0% 0 3.15s 234 420
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 3.6 7.2 22.2% 1 139.90s 18 566,210
GPT-5.2 5.9 7.2 55.6% 1 77.80s 42 10,342
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 5.0 2.1 66.7% 1 45.69s 95 64,644
GPT-5.2 3.7 9.7 0.0% 0 4.32s 162 269
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 7.3 5.8 83.3% 1 23.26s 52 3,549
GPT-5.2 9.9 10.0 100.0% 0 3.12s 94 614
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 5.7 6.8 44.4% 1 50.83s 213 193,654
GPT-5.2 7.6 7.3 77.8% 1 5.47s 609 938
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 6.44s 234 2,601
GPT-5.2 4.7 1.6 66.7% 1 10.30s 239 469
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite - - - - - - - -
GPT-5.2 3.0 10.0 0.0% 0 28.18s 26 3,223

مقارنة سريعة

تبديل زوج المقارنة