التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs OpenAI: GPT-5.5

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-26

المقياس Claude Opus 4.7 Claude Opus 4.7 medium الإصدار: 2026-04-16 GPT-5.5 GPT-5.5 low الإصدار: 2026-04-24
النتيجة 9.2 9.0
الترتيب #3 #5
الموثوقية غير متاح 10.0
الاتساق 10.0 9.6
اختبارات صحيحة
معدل النجاح لكل محاولة 88.9% 87.0%
اختبارات غير مستقرة 0 1
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 2.790 4.534
إجمالي التكلفة $0.447 $0.681
??? ??????? $5.000 / 1M $5.000 / 1M
??? ??????? $25.000 / 1M $30.000 / 1M
رموز الإخراج 5,375 1,959
رموز الاستدلال 1,341 16,134
زمن الاستجابة (المتوسط) 3.53s 8.39s
زمن الاستجابة (الحد الأقصى) 21.45s 56.19s
زمن الاستجابة (الإجمالي) 60.03s 151.01s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
GPT-5.5 10.0 10.0 100.0% 0 4.15s 232 1,056
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 6.41s 1,141 257
GPT-5.5 10.0 10.0 100.0% 0 7.79s 369 936
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
GPT-5.5 10.0 10.0 100.0% 0 9.56s 303 717
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
GPT-5.5 10.0 10.0 100.0% 0 3.28s 228 157
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
GPT-5.5 5.3 10.0 33.3% 0 27.57s 69 11,731
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
GPT-5.5 10.0 10.0 100.0% 0 3.45s 143 132
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
GPT-5.5 9.9 10.0 100.0% 0 2.98s 93 356
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 2.51s 399 0
GPT-5.5 9.0 7.9 88.9% 1 4.48s 272 948
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
GPT-5.5 10.0 10.0 100.0% 0 4.96s 250 101

مقارنة سريعة

تبديل زوج المقارنة