التنقل
Advertise here

GPT-5.6 Luna (medium) vs Grok 4.20 (medium)

يتقدم GPT-5.6 Luna (medium) في متوسط النتيجة بـ 7.4 مقابل 6.3. لدى GPT-5.6 Luna (medium) تكلفة benchmark أقل عند $0.065 مقابل $1.246. GPT-5.6 Luna (medium) أسرع عند 9.64s مقابل 36.73s، مع معدلات نجاح 62.3% مقابل 58.0%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-01

النماذج المقارنة

الترتيب
#122
إجمالي رموز الإخراج
47,986
زمن الاستجابة (المتوسط)
9.64s
إجمالي التكلفة
$0.065
الترتيب
#224
إجمالي رموز الإخراج
302,087
زمن الاستجابة (المتوسط)
36.73s
إجمالي التكلفة
$1.246
النموذج الموصى به GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 19.3x less than Grok 4.20 (medium).

مقارنة تفصيلية

المقياس GPT-5.6 Luna GPT-5.6 Luna medium الإصدار: 2026-07-09 Grok 4.20 Grok 4.20 medium الإصدار: 2026-03-31
النتيجة 7.4 6.3
الترتيب #122 #224
الموثوقية 10.0 10.0
الاتساق 9.0 8.2
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 62.3% 58.0%
اختبارات غير مستقرة 3 5
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 2.822 14.374
إجمالي التكلفة $0.065 $1.246
سعر الإدخال $0.200 / 1M $1.250 / 1M
سعر الإخراج $1.200 / 1M $2.500 / 1M
سعر قراءة ذاكرة التخزين المؤقت $0.020 / 1M $0.200 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت $0.250 / 1M غير متاح
إجمالي رموز الإدخال 212,780 392,127
رموز الإخراج 6,849 7,754
رموز الاستدلال 41,137 294,333
زمن الاستجابة (المتوسط) 9.64s 36.73s
زمن الاستجابة (الحد الأقصى) 58.09s 199.66s
زمن الاستجابة (الإجمالي) 221.62s 844.68s
المعلمات ~400B الإجمالي (~17B النشطة) ~1T الإجمالي (~100B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
التكلفة
$0.014
الوقت
14.6s
الرموز
2,362 tok

#224 SpaceXAI: Grok 4.20

medium
التكلفة
$0.041
الوقت
110.3s
الرموز
16,336 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

مقارنة سريعة

تبديل زوج المقارنة