التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.5 Flash vs Grok 4.20 Beta

الملخص

مقارنة benchmark بين Gemini 3.5 Flash و Grok 4.20 Beta: يتقدم Gemini 3.5 Flash في متوسط النتيجة بـ 9.6 مقابل 8.5. لدى Grok 4.20 Beta تكلفة benchmark أقل عند $0.750 مقابل $1.115. Gemini 3.5 Flash أسرع عند 8.84s مقابل 9.75s، مع معدلات نجاح 96.8% مقابل 81.5%.

النموذج الموصى به: Gemini 3.5 Flash - It has the strongest score in this comparison (9.6) and the best overall balance of cost and response time across all 2 models.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-10

المقياس Gemini 3.5 Flash Gemini 3.5 Flash high الإصدار: 2026-05-19 Grok 4.20 Beta Grok 4.20 Beta medium الإصدار: 2026-03-12
النتيجة 9.6 8.5
الترتيب #2 #14
الموثوقية 10.0 غير متاح
الاتساق 9.6 9.5
اختبارات صحيحة
معدل النجاح لكل محاولة 96.8% 81.5%
اختبارات غير مستقرة 1 1
إجمالي مرات التشغيل 63 52
التكلفة لكل نتيجة 5.575 4.505
إجمالي التكلفة $1.115 $0.750
سعر الإدخال $1.500 / 1M $5.805 / 1M
سعر الإخراج $9.000 / 1M $5.805 / 1M
إجمالي رموز الإدخال 37,594 35,955
رموز الإخراج 1,975 1,647
رموز الاستدلال 115,638 91,565
زمن الاستجابة (المتوسط) 8.84s 9.75s
زمن الاستجابة (الحد الأقصى) 34.82s 31.36s
زمن الاستجابة (الإجمالي) 185.57s 175.48s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3.5 Flash

high
Cost
$0.208
Time
118.2s
Tokens
23,158 tok

#14 Grok 4.20 Beta

medium
Cost
$0.034
Time
91.0s
Tokens
13,523 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.57s 492 174 4,997
Grok 4.20 Beta 8.7 7.9 91.7% 1 3.16s 2,010 268 7,583
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.96s 8,118 456 47,129
Grok 4.20 Beta 10.0 10.0 100.0% 0 31.36s 360 81 3,987
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.37s 12,873 351 16,323
Grok 4.20 Beta 10.0 10.0 100.0% 0 20.93s 12,909 227 12,212
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.43s 7,548 279 8,466
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.01s 7,761 180 5,281
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 7.6 7.2 77.8% 1 14.09s 633 12 24,721
Grok 4.20 Beta 5.3 10.0 33.3% 0 21.33s 1,764 251 40,255
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.63s 486 115 1,650
Grok 4.20 Beta 10.0 10.0 100.0% 0 5.78s 825 72 3,440
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.35s 615 70 3,799
Grok 4.20 Beta 9.8 10.0 100.0% 0 4.89s 1,362 57 7,123
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.23s 558 241 4,940
Grok 4.20 Beta 10.0 10.0 100.0% 0 3.52s 1,689 328 6,300
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 9.8 10.0 100.0% 0 4.96s 6,115 265 1,608
Grok 4.20 Beta 3.0 10.0 0.0% 0 12.39s 7,275 183 5,384
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.94s 156 12 2,005
Grok 4.20 Beta - - - - - - - - -

مقارنة سريعة

تبديل زوج المقارنة