التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Ring 2.6 1t vs StepFun: Step 3.5 Flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-10

المقياس Ring 2.6 1t Ring 2.6 1t medium الإصدار: 2026-05-10 متاح مجانًا Step 3.5 Flash Step 3.5 Flash medium الإصدار: 2026-02-01
النتيجة 7.2 7.6
الترتيب #55 #43
الموثوقية 9.9 10.0
الاتساق 8.7 9.2
اختبارات صحيحة
معدل النجاح لكل محاولة 66.7% 66.7%
اختبارات غير مستقرة 3 2
إجمالي مرات التشغيل 57 54
التكلفة لكل نتيجة 0.000 0.099
إجمالي التكلفة $0.000 $0.011
??? ??????? $0.000 / 1M $0.100 / 1M
??? ??????? $0.000 / 1M $0.300 / 1M
رموز الإخراج 21,752 78,299
رموز الاستدلال 42,754 173,409
زمن الاستجابة (المتوسط) 61.29s 41.66s
زمن الاستجابة (الحد الأقصى) 304.19s 170.45s
زمن الاستجابة (الإجمالي) 1164.50s 499.91s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 10.0 10.0 100.0% 0 42.21s 3,833 4,891
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 20,391 24,176
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 10.0 10.0 100.0% 0 59.65s 1,369 3,985
Step 3.5 Flash - - - - - - - -
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 10.0 10.0 100.0% 0 304.19s 324 6,088
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 1,176 12,984
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 6.5 10.0 50.0% 0 37.36s 840 1,937
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 600 13,886
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 3.5 4.4 33.3% 2 64.92s 9,744 15,013
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 45,350 90,436
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 4.1 10.0 0.0% 0 58.26s 150 583
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 240 3,506
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 9.8 10.0 100.0% 0 11.78s 266 1,831
Step 3.5 Flash 8.5 6.8 83.3% 1 4.98s 2,284 3,412
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 5.9 7.2 55.6% 1 20.73s 697 2,479
Step 3.5 Flash 5.3 10.0 33.3% 0 7.72s 5,629 10,835
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 10.0 10.0 100.0% 0 104.44s 234 1,531
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 275 3,802
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring 2.6 1t 3.0 10.0 0.0% 0 113.91s 4,295 4,416
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 2,354 10,372

مقارنة سريعة

تبديل زوج المقارنة