قارن الرسوم البيانية

اللغة:

❤️ Made by XCS

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Qwen: Qwen3.5-27B

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-03

المقياس	Google: Gemini 3.1 Flash Lite Preview none الإصدار: 2026-03-03	Qwen: Qwen3.5-27B medium الإصدار: 2026-02-24
الترتيب	#10	#5
متوسط الدرجة	7.70	8.55
الاتساق	9.54	9.55
التكلفة لكل نتيجة	0.116	2.950
إجمالي التكلفة	$0.011	$0.325
اختبارات صحيحة
معدل النجاح لكل محاولة	69.1%	83.3%
اختبارات غير مستقرة	1	1
رموز الإخراج	4,307	1,091
رموز الاستدلال	0	131,807

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	رموز الإخراج	رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview	6.00	7.85	55.6%	1		1,086	0
Qwen: Qwen3.5-27B	10.00	10.00	100.0%	0		102	8,956

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	رموز الإخراج	رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview	9.88	10.00	100.0%	0		399	0
Qwen: Qwen3.5-27B	9.88	10.00	100.0%	0		270	16,150

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	رموز الإخراج	رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview	4.00	10.00	33.3%	0		568	0
Qwen: Qwen3.5-27B	4.00	10.00	33.3%	0		43	52,368

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	رموز الإخراج	رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview	9.00	10.00	50.0%	0		574	0
Qwen: Qwen3.5-27B	9.00	6.88	83.3%	1		97	11,638

Puzzle Solving	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	رموز الإخراج	رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview	10.00	10.00	100.0%	0		898	0
Qwen: Qwen3.5-27B	10.00	10.00	100.0%	0		231	41,372

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	رموز الإخراج	رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview	10.00	10.00	100.0%	0		782	0
Qwen: Qwen3.5-27B	10.00	10.00	100.0%	0		348	1,323

مقارنة سريعة

تبديل زوج المقارنة

Gemini 3 Flash PreviewlowvsQwen3.5-27Bmedium Gemini 3.1 Flash Lite PreviewnonevsGPT-5.3-Codexmedium Claude Sonnet 4.6mediumvsGemini 3.1 Flash Lite Previewnone Gemini 3.1 Flash Lite PreviewnonevsGLM 5medium Gemini 3.1 Flash Lite PreviewnonevsStep 3.5 Flashmediumمتاح مجانًا Gemini 3.1 Flash Lite PreviewlowvsQwen3.5-27Bmedium DeepSeek V3.2mediumvsGemini 3.1 Flash Lite Previewnone Gemini 3.1 Flash Lite PreviewnonevsGPT-5.2medium Gemini 3.1 Flash Lite PreviewhighvsQwen3.5-27Bmedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5-122B-A10Bmedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5 Plus 2026-02-15medium GPT-5.2 ChatnonevsQwen3.5-27Bmedium