التنقل
Advertise here

Claude Opus 5.5 (medium) vs GPT-5.5 (low)

يتقدم GPT-5.5 (low) في متوسط النتيجة بـ 9.5 مقابل 9.2. لدى Claude Opus 5.5 (medium) تكلفة benchmark أقل عند $1.804 مقابل $1.822. GPT-5.5 (low) أسرع عند 11.91s مقابل 25.85s، مع معدلات نجاح 89.9% مقابل 87.0%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-07

النماذج المقارنة

الترتيب
#29
إجمالي رموز الإخراج
32,127
زمن الاستجابة (المتوسط)
25.85s
إجمالي التكلفة
$1.804
الترتيب
#22
إجمالي رموز الإخراج
31,065
زمن الاستجابة (المتوسط)
11.91s
إجمالي التكلفة
$1.822
النموذج الموصى به GPT-5.5 (low)

It has the best score here (9.5), while responding about 2.2x faster than Claude Opus 5.5 (medium).

مقارنة تفصيلية

المقياس Claude Opus 5.5 Claude Opus 5.5 medium الإصدار: 2026-09-23 GPT-5.5 GPT-5.5 low الإصدار: 2026-04-24
النتيجة 9.2 9.5
الترتيب #29 #22
الموثوقية 10.0 10.0
الاتساق 9.7 10.0
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 89.9% 87.0%
اختبارات غير مستقرة 1 0
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 9.016 9.109
إجمالي التكلفة $1.804 $1.822
سعر الإدخال $4.000 / 1M $5.000 / 1M
سعر الإخراج $20.000 / 1M $30.000 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.200 / 1M $0.500 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت $5.000 / 1M غير متاح
إجمالي رموز الإدخال 290,117 177,939
رموز الإخراج 9,805 6,283
رموز الاستدلال 22,322 24,782
زمن الاستجابة (المتوسط) 25.85s 11.91s
زمن الاستجابة (الحد الأقصى) 90.20s 56.19s
زمن الاستجابة (الإجمالي) 594.63s 273.82s
المعلمات ~5T الإجمالي (~500B النشطة) ~1.5T الإجمالي (~100B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Opus 5.5

medium
التكلفة
$0.053
الوقت
25.6s
الرموز
2,781 tok

#22 GPT-5.5

low
التكلفة
$0.068
الوقت
37.0s
الرموز
2,339 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Opus 5.5 8.4 7.4 88.9% 1 13.50s 10,608 636 4,341
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

تبديل زوج المقارنة