التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs MoonshotAI: Kimi K2.6

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-28

المقياس Claude Opus 4.8 Claude Opus 4.8 none الإصدار: 2026-05-28 Kimi K2.6 Kimi K2.6 medium الإصدار: 2026-04-20 متاح مجانًا
النتيجة 7.3 7.4
الترتيب #63 #58
الموثوقية 10.0 10.0
الاتساق 9.2 8.3
اختبارات صحيحة
معدل النجاح لكل محاولة 65.0% 70.8%
اختبارات غير مستقرة 2 4
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 4.324 7.621
إجمالي التكلفة $0.519 $0.820
سعر الإدخال $5.000 / 1M $0.730 / 1M
سعر الإخراج $25.000 / 1M $3.490 / 1M
رموز الإخراج 8,098 102,208
رموز الاستدلال 0 229,120
زمن الاستجابة (المتوسط) 3.51s 54.03s
زمن الاستجابة (الحد الأقصى) 17.73s 215.85s
زمن الاستجابة (الإجمالي) 70.19s 1026.57s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 1,472 0
Kimi K2.6 7.0 8.0 66.7% 1 11.59s 7,115 8,934
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 6.8 10.0 50.0% 0 3.59s 1,323 0
Kimi K2.6 6.5 5.3 75.0% 1 118.23s 9,255 52,215
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 3,259 0
Kimi K2.6 10.0 10.0 100.0% 0 40.96s 711 13,876
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 308 0
Kimi K2.6 10.0 10.0 100.0% 0 20.38s 316 11,305
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 61 0
Kimi K2.6 5.3 7.2 44.4% 1 202.38s 47,035 98,262
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 230 0
Kimi K2.6 10.0 10.0 100.0% 0 17.83s 3,981 4,472
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 95 0
Kimi K2.6 10.0 10.0 100.0% 0 12.53s 3,977 5,269
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 783 0
Kimi K2.6 6.0 7.4 55.6% 1 25.06s 13,860 17,599
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 355 0
Kimi K2.6 10.0 10.0 100.0% 0 8.92s 248 1,011
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 212 0
Kimi K2.6 3.0 10.0 0.0% 0 130.27s 15,710 16,177

مقارنة سريعة

تبديل زوج المقارنة