التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs inclusionAI: Ring-2.6-1T

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-03

المقياس Mercury 2 Mercury 2 none الإصدار: 2026-02-24 Ring-2.6-1T Ring-2.6-1T medium الإصدار: 2026-05-10
النتيجة 4.6 7.0
الترتيب #153 #74
الموثوقية 10.0 10.0
الاتساق 9.1 8.7
اختبارات صحيحة
معدل النجاح لكل محاولة 25.0% 63.3%
اختبارات غير مستقرة 2 3
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 0.216 0.000
إجمالي التكلفة $0.009 $0.033
سعر الإدخال $0.250 / 1M $0.075 / 1M
سعر الإخراج $0.750 / 1M $0.625 / 1M
إجمالي رموز الإدخال 25,515 35,892
رموز الإخراج 3,001 21,752
رموز الاستدلال 0 42,754
زمن الاستجابة (المتوسط) 614ms 61.29s
زمن الاستجابة (الحد الأقصى) 1.27s 304.19s
زمن الاستجابة (الإجمالي) 12.28s 1164.50s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 810 3,833 4,891
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
Ring-2.6-1T 6.5 10.0 50.0% 0 59.65s 834 1,369 3,985
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 14,823 324 6,088
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 8,046 840 1,937
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 873 9,744 15,013
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 561 150 583
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 774 266 1,831
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 792 697 2,479
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 8,136 234 1,531
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 243 4,295 4,416

مقارنة سريعة

تبديل زوج المقارنة