التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5-122B-A10B vs Qwen: Qwen3.6 Flash

الملخص

مقارنة benchmark بين Qwen3.5-122B-A10B و Qwen3.6 Flash: يتقدم Qwen3.6 Flash في متوسط النتيجة بـ 6.0 مقابل 5.3. لدى Qwen3.6 Flash تكلفة benchmark أقل عند $0.015 مقابل $0.020. Qwen3.6 Flash أسرع عند 1.60s مقابل 3.41s، مع معدلات نجاح 31.8% مقابل 33.3%.

النموذج الموصى به: Qwen3.6 Flash - It has the best score here (6.0), while responding about 2.1x faster than Qwen3.5-122B-A10B.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-18

المقياس Qwen3.5-122B-A10B Qwen3.5-122B-A10B none الإصدار: 2026-02-24 Qwen3.6 Flash Qwen3.6 Flash none الإصدار: 2026-04-20
النتيجة 5.3 6.0
الترتيب #125 #102
الموثوقية 10.0 10.0
الاتساق 9.6 10.0
اختبارات صحيحة
معدل النجاح لكل محاولة 31.8% 33.3%
اختبارات غير مستقرة 1 0
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.393 0.266
إجمالي التكلفة $0.020 $0.015
سعر الإدخال $0.260 / 1M $0.188 / 1M
سعر الإخراج $2.080 / 1M $1.125 / 1M
إجمالي رموز الإدخال 47,735 50,810
رموز الإخراج 3,383 4,164
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 3.41s 1.60s
زمن الاستجابة (الحد الأقصى) 46.00s 4.60s
زمن الاستجابة (الإجمالي) 71.59s 33.59s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 Qwen3.5-122B-A10B

none
التكلفة
$0.016
الوقت
44.5s
الرموز
6,431 tok

#102 Qwen3.6 Flash

none
التكلفة
$0.005
الوقت
20.1s
الرموز
4,211 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 4.8 10.0 25.0% 0 1.59s 696 312 0
Qwen3.6 Flash 3.1 10.0 0.0% 0 1.63s 696 1,554 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0
Qwen3.6 Flash 5.4 10.0 33.3% 0 1.79s 6,488 889 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 46.00s 20,175 1,137 0
Qwen3.6 Flash 3.0 10.0 0.0% 0 4.22s 24,675 315 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 1.01s 7,794 243 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.13s 7,794 243 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 5.3 10.0 33.3% 0 465ms 789 15 0
Qwen3.6 Flash 5.3 10.0 33.3% 0 1.11s 789 15 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 5.0 10.0 0.0% 0 1.12s 522 66 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 947ms 522 132 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 6.3 10.0 50.0% 0 513ms 711 69 0
Qwen3.6 Flash 6.3 10.0 50.0% 0 1.10s 711 66 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 3.8 10.0 0.0% 0 1.00s 714 575 0
Qwen3.6 Flash 3.5 10.0 0.0% 0 1.21s 714 669 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 2.04s 8,211 264 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.49s 8,211 272 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 295ms 210 9 0
Qwen3.6 Flash 3.0 10.0 0.0% 0 649ms 210 9 0

مقارنة سريعة

تبديل زوج المقارنة