التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Google: Gemini 3.1 Pro Preview

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-29

المقياس Claude Sonnet 4.6 Claude Sonnet 4.6 none الإصدار: 2026-02-17 Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium الإصدار: 2026-02-19
النتيجة 7.0 9.3
الترتيب #78 #4
الموثوقية 10.0 10.0
الاتساق 9.7 10.0
اختبارات صحيحة
معدل النجاح لكل محاولة 58.3% 90.0%
اختبارات غير مستقرة 1 0
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 2.782 5.587
إجمالي التكلفة $0.306 $1.006
سعر الإدخال $3.000 / 1M $2.000 / 1M
سعر الإخراج $15.000 / 1M $12.000 / 1M
رموز الإخراج 9,450 1,971
رموز الاستدلال 0 75,384
زمن الاستجابة (المتوسط) 5.27s 20.77s
زمن الاستجابة (الحد الأقصى) 23.84s 88.68s
زمن الاستجابة (الإجمالي) 68.50s 269.96s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 1,214 0
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.90s 112 3,218
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 6.8 10.0 50.0% 0 6.73s 2,112 0
Gemini 3.1 Pro Preview 7.0 9.8 50.0% 0 54.28s 429 37,735
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 3,766 0
Gemini 3.1 Pro Preview 9.5 10.0 100.0% 0 40.61s 432 9,281
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 252 0
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.72s 279 3,904
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 413 0
Gemini 3.1 Pro Preview 7.7 10.0 66.7% 0 32.73s 18 12,424
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 192 0
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 108 1,179
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 90 0
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 72 2,236
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.53s 533 0
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 6.90s 235 3,128
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 447 0
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 274 982
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 431 0
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 6.27s 12 1,297

مقارنة سريعة

تبديل زوج المقارنة