التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (medium) vs Qwen3.8 2.4T A95B (high)

متوسط النتيجة متقارب جدًا عند 7.4 مقابل 7.4. لدى GPT-5.6 Luna (medium) تكلفة benchmark أقل عند $0.072 مقابل $2.357. GPT-5.6 Luna (medium) أسرع عند 7.43s مقابل 120.59s، مع معدلات نجاح 62.1% مقابل 74.2%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-09-24

النماذج المقارنة

الترتيب
#131
إجمالي رموز الإخراج
44,525
زمن الاستجابة (المتوسط)
7.43s
إجمالي التكلفة
$0.072
الترتيب
#133
إجمالي رموز الإخراج
456,028
زمن الاستجابة (المتوسط)
120.59s
إجمالي التكلفة
$2.357
النموذج الموصى به GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 33.0x less than Qwen3.8 2.4T A95B (high).

مقارنة تفصيلية

المقياس GPT-5.6 Luna GPT-5.6 Luna medium الإصدار: 2026-07-09 Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B high الإصدار: 2026-08-12
النتيجة 7.4 7.4
الترتيب #131 #133
الموثوقية 10.0 9.4
الاتساق 9.2 8.3
محاولات 66/66 66/66
اختبارات صحيحة
معدل النجاح لكل محاولة 62.1% 74.2%
اختبارات غير مستقرة 2 4
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 2.601 16.832
إجمالي التكلفة $0.072 $2.357
سعر الإدخال $0.200 / 1M $2.000 / 1M
سعر الإخراج $1.200 / 1M $6.000 / 1M
إجمالي رموز الإدخال 89,685 108,931
رموز الإخراج 5,701 112,801
رموز الاستدلال 38,824 343,227
زمن الاستجابة (المتوسط) 7.43s 120.59s
زمن الاستجابة (الحد الأقصى) 29.85s 532.28s
زمن الاستجابة (الإجمالي) 163.54s 2653.05s
المعلمات ~400B الإجمالي (~17B النشطة) 2.4T الإجمالي (95B النشطة)
الإتاحة مغلق المصدر الأوزان متاحة

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#131 GPT-5.6 Luna

medium
التكلفة
$0.014
الوقت
14.6s
الرموز
2,362 tok

#133 Qwen3.8 2.4T A95B

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
التكلفة
$0.000
الوقت
600.0s
الرموز
0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Qwen3.8 2.4T A95B 5.9 6.3 55.6% 1 160.52s 6,399 3,310 48,078

مقارنة سريعة

تبديل زوج المقارنة