التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Anthropic: Claude Sonnet 4.6

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-16

المقياس Claude Opus 4.7 Claude Opus 4.7 medium الإصدار: 2026-04-16 Claude Sonnet 4.6 Claude Sonnet 4.6 medium الإصدار: 2026-02-17
النتيجة 9.2 8.0
الترتيب #3 #26
الاتساق 10.0 9.5
اختبارات صحيحة
معدل النجاح لكل محاولة 88.9% 74.1%
اختبارات غير مستقرة 0 1
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 2.790 8.930
إجمالي التكلفة $0.447 $1.161
??? ??????? $5.000 / 1M $3.000 / 1M
??? ??????? $25.000 / 1M $15.000 / 1M
رموز الإخراج 5,375 42,068
رموز الاستدلال 1,341 26,784
زمن الاستجابة (المتوسط) 3.53s 12.66s
زمن الاستجابة (الحد الأقصى) 21.45s 46.35s
زمن الاستجابة (الإجمالي) 60.03s 126.62s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 6.41s 1,141 257
Claude Sonnet 4.6 10.0 10.0 100.0% 0 35.76s 6,894 2,097
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 2.51s 399 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351

مقارنة سريعة

تبديل زوج المقارنة