التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs MoonshotAI: Kimi K2.6

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-19

المقياس Claude Opus 4.6 Claude Opus 4.6 medium الإصدار: 2026-02-05 Kimi K2.6 Kimi K2.6 medium الإصدار: 2026-04-20
النتيجة 7.4 7.6
الترتيب #57 #47
الموثوقية 10.0 10.0
الاتساق 9.1 8.7
اختبارات صحيحة
معدل النجاح لكل محاولة 66.7% 71.9%
اختبارات غير مستقرة 2 3
إجمالي مرات التشغيل 57 57
التكلفة لكل نتيجة 14.243 6.476
إجمالي التكلفة $1.710 $0.778
??? ??????? $5.000 / 1M $0.730 / 1M
??? ??????? $25.000 / 1M $3.490 / 1M
رموز الإخراج 37,874 96,469
رموز الاستدلال 21,390 195,991
زمن الاستجابة (المتوسط) 24.59s 49.92s
زمن الاستجابة (الحد الأقصى) 83.40s 215.85s
زمن الاستجابة (الإجمالي) 295.08s 898.64s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 6.4 5.8 66.7% 2 7.45s 986 1,071
Kimi K2.6 7.0 8.0 66.7% 1 11.59s 7,115 8,934
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 10.0 10.0 100.0% 0 23.11s 3,486 1,504
Kimi K2.6 10.0 10.0 100.0% 0 106.96s 3,236 18,817
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 10.0 10.0 100.0% 0 76.66s 8,178 5,194
Kimi K2.6 10.0 10.0 100.0% 0 40.96s 711 13,876
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 10.0 10.0 100.0% 0 7.37s 691 757
Kimi K2.6 10.0 10.0 100.0% 0 20.38s 316 11,305
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 3.0 10.0 0.0% 0 83.40s 14,642 8,687
Kimi K2.6 5.3 7.2 44.4% 1 202.38s 47,035 98,262
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 10.0 10.0 100.0% 0 5.04s 188 292
Kimi K2.6 10.0 10.0 100.0% 0 17.83s 3,981 4,472
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 10.0 10.0 100.0% 0 2.43s 266 467
Kimi K2.6 10.0 10.0 100.0% 0 12.53s 3,977 5,269
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 7.7 10.0 66.7% 0 4.60s 531 637
Kimi K2.6 6.0 7.4 55.6% 1 25.59s 14,140 17,868
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 10.0 10.0 100.0% 0 9.73s 861 329
Kimi K2.6 10.0 10.0 100.0% 0 8.92s 248 1,011
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.6 3.0 10.0 0.0% 0 63.24s 8,045 2,452
Kimi K2.6 3.0 10.0 0.0% 0 130.27s 15,710 16,177

مقارنة سريعة

تبديل زوج المقارنة