التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-27B vs StepFun: Step 3.7 Flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-02

المقياس Qwen3.5-27B Qwen3.5-27B medium الإصدار: 2026-02-24 Step 3.7 Flash Step 3.7 Flash low الإصدار: 2026-05-29
النتيجة 7.9 7.4
الترتيب #27 #59
الموثوقية 10.0 10.0
الاتساق 8.9 8.7
اختبارات صحيحة
معدل النجاح لكل محاولة 73.3% 68.3%
اختبارات غير مستقرة 3 3
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 4.532 2.796
إجمالي التكلفة $0.488 $0.336
سعر الإدخال $0.195 / 1M $0.200 / 1M
سعر الإخراج $1.560 / 1M $1.150 / 1M
إجمالي رموز الإدخال 39,329 37,458
رموز الإخراج 2,569 285,209
رموز الاستدلال 304,894 0
زمن الاستجابة (المتوسط) 60.09s 16.06s
زمن الاستجابة (الحد الأقصى) 177.36s 124.75s
زمن الاستجابة (الإجمالي) 1201.89s 321.11s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 8.7 7.9 91.7% 1 19.75s 672 569 31,505
Step 3.7 Flash 8.7 7.9 91.7% 1 4.02s 756 10,896 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 7.0 9.8 50.0% 0 123.86s 5,060 416 64,993
Step 3.7 Flash 10.0 10.0 100.0% 0 9.43s 4,794 14,569 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 10.0 10.0 100.0% 0 163.96s 14,946 483 9,991
Step 3.7 Flash 10.0 10.0 100.0% 0 7.98s 13,683 6,426 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 10.0 10.0 100.0% 0 30.26s 7,782 270 16,150
Step 3.7 Flash 7.3 5.8 83.3% 1 2.29s 7,398 2,667 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 5.3 10.0 33.3% 0 79.53s 553 43 52,368
Step 3.7 Flash 5.3 7.2 44.4% 1 43.31s 828 104,487 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 6.1 3.1 66.7% 1 101.41s 524 70 23,147
Step 3.7 Flash 3.4 9.3 0.0% 0 7.00s 525 4,604 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 10.0 10.0 100.0% 0 19.66s 699 97 11,638
Step 3.7 Flash 9.8 10.0 100.0% 0 1.58s 735 1,857 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 8.2 7.7 77.8% 1 59.60s 696 242 70,096
Step 3.7 Flash 5.5 9.9 33.3% 0 1.84s 756 3,564 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 10.0 10.0 100.0% 0 7.45s 8,193 348 1,323
Step 3.7 Flash 10.0 10.0 100.0% 0 3.25s 7,746 1,360 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Qwen3.5-27B 3.0 10.0 0.0% 0 85.11s 204 31 23,683
Step 3.7 Flash 3.0 10.0 0.0% 0 124.75s 237 134,779 0

مقارنة سريعة

تبديل زوج المقارنة