التنقل
Advertise here

Claude Opus 5.5 (medium) vs GPT-5.3-Codex (medium)

يتقدم Claude Opus 5.5 (medium) في متوسط النتيجة بـ 9.2 مقابل 9.1. لدى GPT-5.3-Codex (medium) تكلفة benchmark أقل عند $1.318 مقابل $1.804. GPT-5.3-Codex (medium) أسرع عند 18.87s مقابل 25.85s، مع معدلات نجاح 89.9% مقابل 84.1%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-07

النماذج المقارنة

الترتيب
#29
إجمالي رموز الإخراج
32,127
زمن الاستجابة (المتوسط)
25.85s
إجمالي التكلفة
$1.804
الترتيب
#34
إجمالي رموز الإخراج
66,287
زمن الاستجابة (المتوسط)
18.87s
إجمالي التكلفة
$1.318
النموذج الموصى به GPT-5.3-Codex (medium)

It offers the best overall trade-off: a competitive score (9.1), lower cost than Claude Opus 5.5 (medium), and balanced response time.

مقارنة تفصيلية

المقياس Claude Opus 5.5 Claude Opus 5.5 medium الإصدار: 2026-09-23 GPT-5.3-Codex GPT-5.3-Codex medium الإصدار: 2026-02-05
النتيجة 9.2 9.1
الترتيب #29 #34
الموثوقية 10.0 10.0
الاتساق 9.7 8.6
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 89.9% 84.1%
اختبارات غير مستقرة 1 4
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 9.016 7.753
إجمالي التكلفة $1.804 $1.318
سعر الإدخال $4.000 / 1M $1.750 / 1M
سعر الإخراج $20.000 / 1M $14.000 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.200 / 1M $0.175 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت $5.000 / 1M غير متاح
إجمالي رموز الإدخال 290,117 222,794
رموز الإخراج 9,805 7,357
رموز الاستدلال 22,322 58,930
زمن الاستجابة (المتوسط) 25.85s 18.87s
زمن الاستجابة (الحد الأقصى) 90.20s 100.93s
زمن الاستجابة (الإجمالي) 594.63s 433.94s
المعلمات ~5T الإجمالي (~500B النشطة) ~1.2T الإجمالي (~80B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Opus 5.5

medium
التكلفة
$0.053
الوقت
25.6s
الرموز
2,781 tok

#34 GPT-5.3-Codex

medium
التكلفة
$0.049
الوقت
54.9s
الرموز
3,580 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Opus 5.5 8.4 7.4 88.9% 1 13.50s 10,608 636 4,341
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

تبديل زوج المقارنة