التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 2.5 Flash vs Google: Gemini 3.1 Flash Lite Preview

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-17

المقياس Gemini 2.5 Flash Gemini 2.5 Flash medium الإصدار: 2025-06-17 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low الإصدار: 2026-03-03
الترتيب #13 #17
النتيجة 8.1 8.0
الاتساق 9.5 10.0
التكلفة لكل نتيجة 2.430 0.168
إجمالي التكلفة $0.292 $0.021
اختبارات صحيحة
معدل النجاح لكل محاولة 74.5% 70.6%
اختبارات غير مستقرة 1 0
إجمالي مرات التشغيل 51 51
رموز الإخراج 1,376 1,617
رموز الاستدلال 111,923 7,686
زمن الاستجابة (المتوسط) 11.88s 3.28s
زمن الاستجابة (الحد الأقصى) 95.48s 11.91s
زمن الاستجابة (الإجمالي) 201.89s 55.80s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 255 10,233
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 462 1,638
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 225 762
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 291 696
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 18 1,212
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 69 384
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 72 753
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.76s 243 1,248
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 237 993

مقارنة سريعة

تبديل زوج المقارنة