التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs MiniMax: MiniMax M3

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-03

المقياس Claude Sonnet 4.6 Claude Sonnet 4.6 none الإصدار: 2026-02-17 MiniMax M3 MiniMax M3 medium الإصدار: 2026-06-01
النتيجة 7.0 7.2
الترتيب #72 #67
الموثوقية 10.0 9.6
الاتساق 9.7 8.2
اختبارات صحيحة
معدل النجاح لكل محاولة 58.3% 65.0%
اختبارات غير مستقرة 1 4
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 2.782 1.083
إجمالي التكلفة $0.306 $0.120
سعر الإدخال $3.000 / 1M $0.300 / 1M
سعر الإخراج $15.000 / 1M $1.200 / 1M
إجمالي رموز الإدخال 54,721 43,447
رموز الإخراج 9,450 46,884
رموز الاستدلال 0 85,935
زمن الاستجابة (المتوسط) 5.27s 68.44s
زمن الاستجابة (الحد الأقصى) 23.84s 431.03s
زمن الاستجابة (الإجمالي) 68.50s 1300.32s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 636 1,214 0
MiniMax M3 5.5 3.7 66.7% 3 14.95s 2,526 874 3,414
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 6.8 10.0 50.0% 0 6.73s 5,357 2,112 0
MiniMax M3 6.8 8.9 50.0% 0 185.58s 2,705 4,071 26,059
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 26,024 3,766 0
MiniMax M3 10.0 10.0 100.0% 0 65.30s 14,760 1,306 6,253
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 8,574 252 0
MiniMax M3 10.0 10.0 100.0% 0 14.92s 8,088 514 3,164
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 759 413 0
MiniMax M3 5.5 9.3 33.3% 0 233.13s 869 16,254 19,070
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 513 192 0
MiniMax M3 5.1 3.4 33.3% 1 33.25s 954 2,487 2,523
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 690 90 0
MiniMax M3 9.8 10.0 100.0% 0 6.14s 1,623 103 920
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.53s 663 533 0
MiniMax M3 7.9 9.9 66.7% 0 49.91s 2,079 11,946 13,761
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 11,301 447 0
MiniMax M3 10.0 10.0 100.0% 0 11.91s 9,168 281 555
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 204 431 0
MiniMax M3 3.0 10.0 0.0% 0 100.80s 675 9,048 10,216

مقارنة سريعة

تبديل زوج المقارنة