التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Qwen: Qwen3.5 Plus 2026-02-15

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-03

المقياس Google: Gemini 3.1 Flash Lite Preview high الإصدار: 2026-03-03 Qwen: Qwen3.5 Plus 2026-02-15 medium الإصدار: 2026-02-15
الترتيب #9 #4
متوسط الدرجة 7.77 8.64
الاتساق 9.99 10.00
التكلفة لكل نتيجة 17.286 1.955
إجمالي التكلفة $1.729 $0.235
اختبارات صحيحة
معدل النجاح لكل محاولة 71.4% 85.7%
اختبارات غير مستقرة 0 0
رموز الإخراج 831 1,258
رموز الاستدلال 1,148,955 93,374

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 10.00 10.00 100.0% 0 144 193,077
Qwen: Qwen3.5 Plus 2026-02-15 10.00 10.00 100.0% 0 186 5,926
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 9.88 10.00 100.0% 0 279 6,186
Qwen: Qwen3.5 Plus 2026-02-15 10.00 10.00 100.0% 0 283 14,892
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 4.00 10.00 33.3% 0 18 566,202
Qwen: Qwen3.5 Plus 2026-02-15 4.00 10.00 33.3% 0 56 39,882
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 8.00 9.96 50.0% 0 69 190,053
Qwen: Qwen3.5 Plus 2026-02-15 9.50 9.99 100.0% 0 102 9,257
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 7.00 10.00 66.7% 0 87 190,953
Qwen: Qwen3.5 Plus 2026-02-15 10.00 10.00 100.0% 0 322 22,508
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
Google: Gemini 3.1 Flash Lite Preview 10.00 10.00 100.0% 0 234 2,484
Qwen: Qwen3.5 Plus 2026-02-15 10.00 10.00 100.0% 0 309 909

مقارنة سريعة

تبديل زوج المقارنة