التنقل
Advertise here

Claude Haiku 5.5 (xhigh) vs GPT-5.3-Codex (medium)

متوسط النتيجة متقارب جدًا عند 9.1 مقابل 9.1. لدى Claude Haiku 5.5 (xhigh) تكلفة benchmark أقل عند $0.140 مقابل $1.318. Claude Haiku 5.5 (xhigh) أسرع عند 16.58s مقابل 18.87s، مع معدلات نجاح 81.2% مقابل 84.1%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-07

النماذج المقارنة

الترتيب
#35
إجمالي رموز الإخراج
199,268
زمن الاستجابة (المتوسط)
16.58s
إجمالي التكلفة
$0.140
الترتيب
#34
إجمالي رموز الإخراج
66,287
زمن الاستجابة (المتوسط)
18.87s
إجمالي التكلفة
$1.318
النموذج الموصى به Claude Haiku 5.5 (xhigh)

It has the best score here (9.1), while costing about 9.5x less than GPT-5.3-Codex (medium).

مقارنة تفصيلية

المقياس Claude Haiku 5.5 Claude Haiku 5.5 xhigh الإصدار: 2026-10-07 GPT-5.3-Codex GPT-5.3-Codex medium الإصدار: 2026-02-05
النتيجة 9.1 9.1
الترتيب #35 #34
الموثوقية 10.0 10.0
الاتساق 9.3 8.6
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 81.2% 84.1%
اختبارات غير مستقرة 2 4
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 0.773 7.753
إجمالي التكلفة $0.140 $1.318
سعر الإدخال $0.100 / 1M $1.750 / 1M
سعر الإخراج $0.500 / 1M $14.000 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.010 / 1M $0.175 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت $0.125 / 1M غير متاح
إجمالي رموز الإدخال 394,509 222,794
رموز الإخراج 10,349 7,357
رموز الاستدلال 188,919 58,930
زمن الاستجابة (المتوسط) 16.58s 18.87s
زمن الاستجابة (الحد الأقصى) 92.74s 100.93s
زمن الاستجابة (الإجمالي) 381.40s 433.94s
المعلمات ~50B ~1.2T الإجمالي (~80B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Claude Haiku 5.5

xhigh
التكلفة
$0.021
الوقت
189.0s
الرموز
41,343 tok

#34 GPT-5.3-Codex

medium
التكلفة
$0.049
الوقت
54.9s
الرموز
3,580 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Haiku 5.5 10.0 10.0 100.0% 0 13.13s 10,608 504 26,396
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

تبديل زوج المقارنة