التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Qwen: Qwen3.5-122B-A10B

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-03

المقياس Google: Gemini 3.1 Flash Lite Preview none الإصدار: 2026-03-03 Qwen: Qwen3.5-122B-A10B medium الإصدار: 2026-02-24
الترتيب #10 #21
متوسط الدرجة 7.70 6.77
الاتساق 9.54 8.22
التكلفة لكل نتيجة 0.116 5.137
إجمالي التكلفة $0.011 $0.463
اختبارات صحيحة
معدل النجاح لكل محاولة 69.1% 76.2%
اختبارات غير مستقرة 1 3
رموز الإخراج 4,307 16,751
رموز الاستدلال 0 125,394

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 6.00 7.85 55.6% 1 1,086 0
Qwen: Qwen3.5-122B-A10B 10.00 10.00 100.0% 0 248 10,486
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 9.88 10.00 100.0% 0 399 0
Qwen: Qwen3.5-122B-A10B 9.88 10.00 100.0% 0 270 16,558
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 4.00 10.00 33.3% 0 568 0
Qwen: Qwen3.5-122B-A10B 1.00 7.21 11.1% 1 15,537 64,889
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 9.00 10.00 50.0% 0 574 0
Qwen: Qwen3.5-122B-A10B 5.50 5.92 83.3% 1 77 7,372
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 10.00 10.00 100.0% 0 898 0
Qwen: Qwen3.5-122B-A10B 7.00 7.21 88.9% 1 297 24,863
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 10.00 10.00 100.0% 0 782 0
Qwen: Qwen3.5-122B-A10B 10.00 10.00 100.0% 0 322 1,226

مقارنة سريعة

تبديل زوج المقارنة