التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs OpenAI: GPT-5 Mini

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-03

المقياس Google: Gemini 3 Flash Preview medium الإصدار: 2025-12-17 OpenAI: GPT-5 Mini medium الإصدار: 2025-08-07
الترتيب #1 #33
متوسط الدرجة 9.93 5.77
الاتساق 10.00 8.79
التكلفة لكل نتيجة 0.815 1.200
إجمالي التكلفة $0.114 $0.084
اختبارات صحيحة
معدل النجاح لكل محاولة 100.0% 57.1%
اختبارات غير مستقرة 0 2
رموز الإخراج 1,111 4,723
رموز الاستدلال 34,409 35,392

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.00 10.00 100.0% 0 299 3,127
OpenAI: GPT-5 Mini 7.00 9.62 66.7% 0 1,645 5,824
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.00 10.00 100.0% 0 292 5,467
OpenAI: GPT-5 Mini 9.88 10.00 100.0% 0 453 3,200
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.00 10.00 100.0% 0 12 15,295
OpenAI: GPT-5 Mini 1.00 7.21 22.2% 1 293 14,016
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.00 10.00 100.0% 0 72 4,092
OpenAI: GPT-5 Mini 7.00 6.64 66.7% 1 318 4,992
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 9.67 10.00 100.0% 0 202 5,298
OpenAI: GPT-5 Mini 4.33 9.78 33.3% 0 1,527 5,760
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3 Flash Preview 10.00 10.00 100.0% 0 234 1,130
OpenAI: GPT-5 Mini 10.00 10.00 100.0% 0 487 1,600

مقارنة سريعة

تبديل زوج المقارنة