AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs LiquidAI: LFM2-24B-A2B

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-22

المقياس	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium الإصدار: 2026-02-19	LFM2-24B-A2B LFM2-24B-A2B none الإصدار: 2026-02-24

المقياس	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium الإصدار: 2026-02-19	LFM2-24B-A2B LFM2-24B-A2B none الإصدار: 2026-02-24
النتيجة	9.3	4.2
الترتيب	#4	#152
الموثوقية	10.0	غير متاح
الاتساق	10.0	9.0
اختبارات صحيحة
معدل النجاح لكل محاولة	90.0%	18.8%
اختبارات غير مستقرة	0	2
إجمالي مرات التشغيل	60	48
التكلفة لكل نتيجة	5.586	0.024
إجمالي التكلفة	$1.006	$0.001
??? ???????	$2.000 / 1M	$0.030 / 1M
??? ???????	$12.000 / 1M	$0.120 / 1M
رموز الإخراج	1,968	1,185
رموز الاستدلال	75,373	0
زمن الاستجابة (المتوسط)	20.80s	811ms
زمن الاستجابة (الحد الأقصى)	88.68s	2.88s
زمن الاستجابة (الإجمالي)	270.46s	11.35s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.90s	112	3,218
LFM2-24B-A2B	3.3	9.8	0.0%	0		471ms	490	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	7.0	9.8	50.0%	0		54.28s	429	37,735
LFM2-24B-A2B	-	-	-	-	-	-	-	-

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	9.5	10.0	100.0%	0		40.61s	432	9,281
LFM2-24B-A2B	3.0	10.0	0.0%	0		0ms	0	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.72s	279	3,904
LFM2-24B-A2B	3.0	10.0	0.0%	0		714ms	219	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	7.7	10.0	66.7%	0		32.73s	18	12,424
LFM2-24B-A2B	5.9	7.2	55.6%	1		287ms	30	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		11.77s	108	1,179
LFM2-24B-A2B	4.0	10.0	0.0%	0		395ms	72	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		9.56s	72	2,236
LFM2-24B-A2B	6.3	10.0	50.0%	0		1.09s	60	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.15s	232	3,117
LFM2-24B-A2B	3.7	7.7	11.1%	1		1.69s	314	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		23.15s	274	982
LFM2-24B-A2B	3.0	10.0	0.0%	0		0ms	0	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		6.27s	12	1,297
LFM2-24B-A2B	-	-	-	-	-	-	-	-

مقارنة سريعة

تبديل زوج المقارنة

Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Gemini 3.1 Pro PreviewmediumvsQwen3.7 Maxnone Gemini 3.1 Pro PreviewmediumvsGPT-5.2 Chatnone Gemini 3.1 Pro PreviewmediumvsGPT-5.3 Chatnone DeepSeek V4 Flashhighمتاح مجانًاvsGemini 3.1 Pro Previewmedium Gemini 3.1 Pro PreviewmediumvsRing-2.6-1Tnone Gemini 3.1 Pro PreviewmediumvsQwen3.6 Max Previewnone Claude Sonnet 4.6nonevsGemini 3.1 Pro Previewmedium DeepSeek V4 ProhighvsGemini 3.1 Pro Previewmedium Gemini 3.1 Pro PreviewmediumvsGrok Build 0.1none Gemini 3.1 Pro PreviewmediumvsGPT-5.5none Gemini 3.1 Pro PreviewmediumvsQwen3.5 Plus 2026-02-15none