التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

inclusionAI: Ring-2.6-1T vs MoonshotAI: Kimi K2.5

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-22

المقياس Ring-2.6-1T Ring-2.6-1T medium الإصدار: 2026-05-10 Kimi K2.5 Kimi K2.5 none الإصدار: 2026-01-27
النتيجة 7.2 5.3
الترتيب #61 #126
الموثوقية 9.9 10.0
الاتساق 8.7 8.9
اختبارات صحيحة
معدل النجاح لكل محاولة 66.7% 36.7%
اختبارات غير مستقرة 3 3
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 0.000 0.428
إجمالي التكلفة $0.000 $0.026
??? ??????? $0.075 / 1M $0.400 / 1M
??? ??????? $0.625 / 1M $1.900 / 1M
رموز الإخراج 21,752 6,734
رموز الاستدلال 42,754 0
زمن الاستجابة (المتوسط) 61.29s 14.16s
زمن الاستجابة (الحد الأقصى) 304.19s 42.13s
زمن الاستجابة (الإجمالي) 1164.50s 184.10s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 3,833 4,891
Kimi K2.5 3.6 8.4 8.3% 1 6.24s 373 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 10.0 10.0 100.0% 0 59.65s 1,369 3,985
Kimi K2.5 6.8 10.0 50.0% 0 35.97s 4,704 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 324 6,088
Kimi K2.5 2.8 2.1 33.3% 1 19.16s 748 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 840 1,937
Kimi K2.5 7.3 5.8 83.3% 1 42.13s 187 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 9,744 15,013
Kimi K2.5 5.3 10.0 33.3% 0 4.38s 29 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 150 583
Kimi K2.5 10.0 10.0 100.0% 0 4.00s 76 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 266 1,831
Kimi K2.5 6.5 10.0 50.0% 0 2.67s 60 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 697 2,479
Kimi K2.5 3.0 10.0 0.0% 0 4.73s 317 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 234 1,531
Kimi K2.5 10.0 10.0 100.0% 0 13.99s 220 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 4,295 4,416
Kimi K2.5 3.0 10.0 0.0% 0 3.90s 20 0

مقارنة سريعة

تبديل زوج المقارنة