AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Grok 4.20 Beta

الملخص

مقارنة benchmark بين Gemini 3 Flash Preview و Grok 4.20 Beta: يتقدم Gemini 3 Flash Preview في متوسط النتيجة بـ 9.8 مقابل 8.5. لدى Gemini 3 Flash Preview تكلفة benchmark أقل عند $0.667 مقابل $0.750. Grok 4.20 Beta أسرع عند 9.75s مقابل 18.64s، مع معدلات نجاح 98.4% مقابل 81.5%.

النموذج الموصى به: Gemini 3 Flash Preview - It has the strongest score in this comparison (9.8) and the best overall balance of cost and response time across all 2 models.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-10

المقياس	Gemini 3 Flash Preview Gemini 3 Flash Preview medium الإصدار: 2025-12-17	Grok 4.20 Beta Grok 4.20 Beta medium الإصدار: 2026-03-12

المقياس	Gemini 3 Flash Preview Gemini 3 Flash Preview medium الإصدار: 2025-12-17	Grok 4.20 Beta Grok 4.20 Beta medium الإصدار: 2026-03-12
النتيجة	9.8	8.5
الترتيب	#1	#14
الموثوقية	10.0	غير متاح
الاتساق	9.7	9.5
اختبارات صحيحة
معدل النجاح لكل محاولة	98.4%	81.5%
اختبارات غير مستقرة	1	1
إجمالي مرات التشغيل	63	52
التكلفة لكل نتيجة	3.335	4.505
إجمالي التكلفة	$0.667	$0.750
سعر الإدخال	$0.500 / 1M	$5.805 / 1M
سعر الإخراج	$3.000 / 1M	$5.805 / 1M
إجمالي رموز الإدخال	37,017	35,955
رموز الإخراج	2,006	1,647
رموز الاستدلال	214,153	91,565
زمن الاستجابة (المتوسط)	18.64s	9.75s
زمن الاستجابة (الحد الأقصى)	117.26s	31.36s
زمن الاستجابة (الإجمالي)	391.35s	175.48s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#1 Gemini 3 Flash Preview

medium

Cost: $0.010
Time: 17.9s
Tokens: 3,236 tok

#14 Grok 4.20 Beta

medium

Cost: $0.034
Time: 91.0s
Tokens: 13,523 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		3.88s	494	330	3,216
Grok 4.20 Beta	8.7	7.9	91.7%	1		3.16s	2,010	268	7,583

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	8.6	7.6	88.9%	1		84.40s	8,122	462	161,084
Grok 4.20 Beta	10.0	10.0	100.0%	0		31.36s	360	81	3,987

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		22.42s	12,873	351	10,485
Grok 4.20 Beta	10.0	10.0	100.0%	0		20.93s	12,909	227	12,212

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.43s	7,548	279	4,893
Grok 4.20 Beta	10.0	10.0	100.0%	0		4.01s	7,761	180	5,281

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		15.27s	633	12	21,684
Grok 4.20 Beta	5.3	10.0	33.3%	0		21.33s	1,764	251	40,255

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.19s	486	72	1,905
Grok 4.20 Beta	10.0	10.0	100.0%	0		5.78s	825	72	3,440

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.04s	615	72	2,709
Grok 4.20 Beta	9.8	10.0	100.0%	0		4.89s	1,362	57	7,123

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.05s	558	183	4,365
Grok 4.20 Beta	10.0	10.0	100.0%	0		3.52s	1,689	328	6,300

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		12.60s	5,532	234	1,487
Grok 4.20 Beta	3.0	10.0	0.0%	0		12.39s	7,275	183	5,384

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.50s	156	11	2,325
Grok 4.20 Beta	-	-	-	-	-	-	-	-	-

مقارنة سريعة

تبديل زوج المقارنة