التنقل
Advertise here

Claude Haiku 5.5 (xhigh) vs GPT-6 Luna (high)

يتقدم Claude Haiku 5.5 (xhigh) في متوسط النتيجة بـ 9.1 مقابل 7.7. لدى GPT-6 Luna (high) تكلفة benchmark أقل عند $0.074 مقابل $0.140. Claude Haiku 5.5 (xhigh) أسرع عند 16.58s مقابل 20.37s، مع معدلات نجاح 81.2% مقابل 73.9%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-07

النماذج المقارنة

الترتيب
#35
إجمالي رموز الإخراج
199,268
زمن الاستجابة (المتوسط)
16.58s
إجمالي التكلفة
$0.140
الترتيب
#118
إجمالي رموز الإخراج
101,587
زمن الاستجابة (المتوسط)
20.37s
إجمالي التكلفة
$0.074
النموذج الموصى به Claude Haiku 5.5 (xhigh)

يحقق أعلى نتيجة في هذه المقارنة (9.1) وأفضل توازن عام بين التكلفة وزمن الاستجابة بين النماذج المقارَنة (2).

مقارنة تفصيلية

المقياس Claude Haiku 5.5 Claude Haiku 5.5 xhigh الإصدار: 2026-10-07 GPT-6 Luna GPT-6 Luna high الإصدار: 2026-09-23
النتيجة 9.1 7.7
الترتيب #35 #118
الموثوقية 10.0 10.0
الاتساق 9.3 8.7
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 81.2% 73.9%
اختبارات غير مستقرة 2 4
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 0.773 0.492
إجمالي التكلفة $0.140 $0.074
سعر الإدخال $0.100 / 1M $0.100 / 1M
سعر الإخراج $0.500 / 1M $0.500 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.010 / 1M $0.010 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت $0.125 / 1M $0.125 / 1M
إجمالي رموز الإدخال 394,509 229,986
رموز الإخراج 10,349 6,037
رموز الاستدلال 188,919 95,550
زمن الاستجابة (المتوسط) 16.58s 20.37s
زمن الاستجابة (الحد الأقصى) 92.74s 106.93s
زمن الاستجابة (الإجمالي) 381.40s 468.52s
المعلمات ~50B ~400B الإجمالي (~17B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Claude Haiku 5.5

xhigh
التكلفة
$0.021
الوقت
189.0s
الرموز
41,343 tok

#118 GPT-6 Luna

high
التكلفة
$0.003
الوقت
49.2s
الرموز
5,231 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Claude Haiku 5.5 10.0 10.0 100.0% 0 13.13s 10,608 504 26,396
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

تبديل زوج المقارنة