AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Owl Alpha

الملخص

مقارنة benchmark بين Gemini 3 Flash Preview و Owl Alpha: يتقدم Gemini 3 Flash Preview في متوسط النتيجة بـ 9.6 مقابل 5.8. لدى Owl Alpha تكلفة benchmark أقل عند $0.000 مقابل $0.667. Owl Alpha أسرع عند 11.95s مقابل 18.64s، مع معدلات نجاح 98.4% مقابل 39.7%.

النموذج الموصى به: Gemini 3 Flash Preview - It has the strongest score in this comparison (9.6) and the best overall balance of cost and response time across all 2 models.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-12

المقياس	Gemini 3 Flash Preview Gemini 3 Flash Preview medium الإصدار: 2025-12-17	Owl Alpha Owl Alpha medium الإصدار: 2026-04-30

المقياس	Gemini 3 Flash Preview Gemini 3 Flash Preview medium الإصدار: 2025-12-17	Owl Alpha Owl Alpha medium الإصدار: 2026-04-30
النتيجة	9.6	5.8
الترتيب	#2	#112
الموثوقية	10.0	10.0
الاتساق	9.7	9.6
اختبارات صحيحة
معدل النجاح لكل محاولة	98.4%	39.7%
اختبارات غير مستقرة	1	1
إجمالي مرات التشغيل	63	63
التكلفة لكل نتيجة	3.335	0.000
إجمالي التكلفة	$0.667	$0.000
سعر الإدخال	$0.500 / 1M	$0.000 / 1M
سعر الإخراج	$3.000 / 1M	$0.000 / 1M
إجمالي رموز الإدخال	37,017	43,478
رموز الإخراج	2,006	2,974
رموز الاستدلال	214,153	0
زمن الاستجابة (المتوسط)	18.64s	11.95s
زمن الاستجابة (الحد الأقصى)	117.26s	58.63s
زمن الاستجابة (الإجمالي)	391.35s	250.88s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3 Flash Preview

medium

Cost: $0.010
Time: 17.9s
Tokens: 3,236 tok

#112 Owl Alpha

medium

Provider returned error

Cost: $0.000
Time: 0.2s
Tokens: 0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		3.88s	494	330	3,216
Owl Alpha	4.8	10.0	25.0%	0		3.97s	1,596	87	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	8.6	7.6	88.9%	1		84.40s	8,122	462	161,084
Owl Alpha	5.4	10.0	33.3%	0		18.74s	6,749	1,763	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		22.42s	12,873	351	10,485
Owl Alpha	3.0	10.0	0.0%	0		10.01s	14,259	315	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.43s	7,548	279	4,893
Owl Alpha	10.0	10.0	100.0%	0		21.64s	8,157	246	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		15.27s	633	12	21,684
Owl Alpha	5.3	10.0	33.3%	0		8.58s	1,458	28	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.19s	486	72	1,905
Owl Alpha	4.3	10.0	0.0%	0		58.63s	732	98	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.04s	615	72	2,709
Owl Alpha	6.5	10.0	50.0%	0		10.15s	1,161	57	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.05s	558	183	4,365
Owl Alpha	5.3	7.2	44.4%	1		3.40s	1,392	135	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		12.60s	5,532	234	1,487
Owl Alpha	10.0	10.0	100.0%	0		8.26s	7,524	228	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.50s	156	11	2,325
Owl Alpha	3.0	10.0	0.0%	0		2.38s	450	17	0

مقارنة سريعة

تبديل زوج المقارنة