التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.4 Nano (medium) vs Qwen3.8 2.4T A95B (high)

يتقدم GPT-5.4 Nano (medium) في متوسط النتيجة بـ 8.0 مقابل 7.9. لدى GPT-5.4 Nano (medium) تكلفة benchmark أقل عند $0.187 مقابل $2.805. GPT-5.4 Nano (medium) أسرع عند 15.95s مقابل 120.88s، مع معدلات نجاح 66.7% مقابل 75.4%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-01

النماذج المقارنة

الترتيب
#93
إجمالي رموز الإخراج
110,910
زمن الاستجابة (المتوسط)
15.95s
إجمالي التكلفة
$0.187
الترتيب
#102
إجمالي رموز الإخراج
468,439
زمن الاستجابة (المتوسط)
120.88s
إجمالي التكلفة
$2.805
النموذج الموصى به GPT-5.4 Nano (medium)

It has the best score here (8.0), while costing about 15.1x less than Qwen3.8 2.4T A95B (high).

مقارنة تفصيلية

المقياس GPT-5.4 Nano GPT-5.4 Nano medium الإصدار: 2026-03-17 Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B high الإصدار: 2026-08-12
النتيجة 8.0 7.9
الترتيب #93 #102
الموثوقية 10.0 9.6
الاتساق 8.6 8.4
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 66.7% 75.4%
اختبارات غير مستقرة 4 4
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 1.432 18.696
إجمالي التكلفة $0.187 $2.805
سعر الإدخال $0.200 / 1M $2.000 / 1M
سعر الإخراج $1.250 / 1M $6.000 / 1M
إجمالي رموز الإدخال 237,088 295,642
رموز الإخراج 8,235 115,041
رموز الاستدلال 102,675 353,398
زمن الاستجابة (المتوسط) 15.95s 120.88s
زمن الاستجابة (الحد الأقصى) 94.06s 532.28s
زمن الاستجابة (الإجمالي) 366.93s 2780.16s
المعلمات ~120B الإجمالي (~5B النشطة) 2.4T الإجمالي (95B النشطة)
الإتاحة مغلق المصدر الأوزان متاحة

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 GPT-5.4 Nano

medium
التكلفة
$0.007
الوقت
24.6s
الرموز
4,943 tok

#102 Qwen3.8 2.4T A95B

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
التكلفة
$0.000
الوقت
600.0s
الرموز
0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Qwen3.8 2.4T A95B 5.9 6.3 55.6% 1 160.52s 6,399 3,310 48,078

مقارنة سريعة

تبديل زوج المقارنة