التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Anthropic: Claude Sonnet 5

الملخص

مقارنة benchmark بين Claude Sonnet 4.6 و Claude Sonnet 5: متوسط النتيجة متقارب جدًا عند 7.8 مقابل 7.9. لدى Claude Sonnet 5 تكلفة benchmark أقل عند $0.550 مقابل $1.418. Claude Sonnet 5 أسرع عند 9.94s مقابل 17.06s، مع معدلات نجاح 65.1% مقابل 79.4%.

النموذج الموصى به: Claude Sonnet 5 - It has the best score here (7.9), while costing about 2.6x less than Claude Sonnet 4.6.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-30

المقياس Claude Sonnet 4.6 Claude Sonnet 4.6 medium الإصدار: 2026-02-17 Claude Sonnet 5 Claude Sonnet 5 medium الإصدار: 2026-06-30
النتيجة 7.8 7.9
الترتيب #32 #30
الموثوقية 10.0 10.0
الاتساق 9.1 9.0
اختبارات صحيحة
معدل النجاح لكل محاولة 65.1% 79.4%
اختبارات غير مستقرة 2 3
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 10.904 3.662
إجمالي التكلفة $1.418 $0.550
سعر الإدخال $3.000 / 1M $2.000 / 1M
سعر الإخراج $15.000 / 1M $10.000 / 1M
إجمالي رموز الإدخال 49,112 67,416
رموز الإخراج 54,703 34,012
رموز الاستدلال 29,970 7,673
زمن الاستجابة (المتوسط) 17.06s 9.94s
زمن الاستجابة (الحد الأقصى) 46.35s 56.94s
زمن الاستجابة (الإجمالي) 221.83s 208.71s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 Claude Sonnet 4.6

medium
SVG غير صالح
التكلفة
$0.000
الوقت
300.0s
الرموز
0 tok

#30 Claude Sonnet 5

medium
التكلفة
$0.007
الوقت
6.4s
الرموز
832 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 789 1,046 1,093
Claude Sonnet 5 10.0 10.0 100.0% 0 3.80s 834 1,220 446
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 18,351 5,871 3,962
Claude Sonnet 5 4.5 2.1 66.7% 1 37.01s 29,394 4,848 2,170
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 8,676 649 742
Claude Sonnet 5 10.0 10.0 100.0% 0 3.16s 10,503 312 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 471 25,790 16,919
Claude Sonnet 5 7.7 10.0 66.7% 0 20.38s 975 12,140 1,994
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 564 256 433
Claude Sonnet 5 4.8 3.2 33.3% 1 4.32s 708 264 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 792 318 552
Claude Sonnet 5 9.9 10.0 100.0% 0 3.10s 909 318 269
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 5.31s 816 592 646
Claude Sonnet 5 7.7 10.0 66.7% 0 2.98s 894 407 121
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 11,454 655 351
Claude Sonnet 5 10.0 10.0 100.0% 0 10.70s 12,351 433 90
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 3.0 10.0 0.0% 0 30.09s 204 3,437 1,586
Claude Sonnet 5 3.0 10.0 0.0% 0 7.06s 258 917 204

مقارنة سريعة

تبديل زوج المقارنة