التنقل
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite (low) vs Qwen3.5-27B

متوسط النتيجة متقارب جدًا عند 6.5 مقابل 6.5. لدى Qwen3.5-27B تكلفة benchmark أقل عند $0.058 مقابل $0.621. Qwen3.5-27B أسرع عند 4.76s مقابل 16.26s، مع معدلات نجاح 59.1% مقابل 40.9%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-28

الترتيب
#118
إجمالي رموز الإخراج
397,885
زمن الاستجابة (المتوسط)
16.26s
إجمالي التكلفة
$0.621
الترتيب
#116
إجمالي رموز الإخراج
24,321
زمن الاستجابة (المتوسط)
4.76s
إجمالي التكلفة
$0.058
النموذج الموصى به Qwen3.5-27B

It has the best score here (6.5), while costing about 10.7x less than Gemini 3.1 Flash Lite (low).

مقارنة تفصيلية

المقياس Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low الإصدار: 2026-05-08 Qwen3.5-27B Qwen3.5-27B none الإصدار: 2026-02-24
النتيجة 6.5 6.5
الترتيب #118 #116
الموثوقية 10.0 10.0
الاتساق 9.2 9.3
اختبارات صحيحة
معدل النجاح لكل محاولة 59.1% 40.9%
اختبارات غير مستقرة 2 2
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 5.170 0.763
إجمالي التكلفة $0.621 $0.058
سعر الإدخال $0.250 / 1M $0.195 / 1M
سعر الإخراج $1.500 / 1M $1.560 / 1M
إجمالي رموز الإدخال 94,224 102,316
رموز الإخراج 7,759 24,321
رموز الاستدلال 390,126 0
زمن الاستجابة (المتوسط) 16.26s 4.76s
زمن الاستجابة (الحد الأقصى) 318.02s 69.46s
زمن الاستجابة (الإجمالي) 357.64s 104.71s

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 Gemini 3.1 Flash Lite

low
التكلفة
$0.003
الوقت
4.0s
الرموز
1,479 tok

#116 Qwen3.5-27B

none
التكلفة
$0.007
الوقت
42.9s
الرموز
4,273 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 1.53s 8,132 471 1,072
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

مقارنة سريعة

تبديل زوج المقارنة