التنقل
Advertise here

GPT-5.4 Nano (medium) vs Qwen3.8 Flash Next (low)

متوسط النتيجة متقارب جدًا عند 8.0 مقابل 8.0. لدى Qwen3.8 Flash Next (low) تكلفة benchmark أقل عند ~$0.045 مقابل $0.235. GPT-5.4 Nano (medium) أسرع عند 15.95s مقابل 23.66s، مع معدلات نجاح 66.7% مقابل 79.7%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-05

النماذج المقارنة

الترتيب
#94
إجمالي رموز الإخراج
110,910
زمن الاستجابة (المتوسط)
15.95s
إجمالي التكلفة
$0.235
الترتيب
#96
إجمالي رموز الإخراج
135,295
زمن الاستجابة (المتوسط)
23.66s
إجمالي التكلفة
~$0.045
النموذج الموصى به Qwen3.8 Flash Next (low)

It has the best score here (8.0), while costing about 5.2x less than GPT-5.4 Nano (medium).

مقارنة تفصيلية

المقياس GPT-5.4 Nano GPT-5.4 Nano medium الإصدار: 2026-03-17 Qwen3.8 Flash Next Qwen3.8 Flash Next low الإصدار: 2026-10-04
النتيجة 8.0 8.0
الترتيب #94 #96
الموثوقية 10.0 10.0
الاتساق 8.6 8.0
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 66.7% 79.7%
اختبارات غير مستقرة 4 6
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 1.432 ~0.299
إجمالي التكلفة $0.235 ~$0.045
سعر الإدخال $0.200 / 1M غير متاح
سعر الإخراج $1.250 / 1M غير متاح
سعر قراءة ذاكرة التخزين المؤقت $0.020 / 1M غير متاح
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح غير متاح
إجمالي رموز الإدخال 237,088 342,163
رموز الإخراج 8,235 1,518
رموز الاستدلال 102,675 133,777
زمن الاستجابة (المتوسط) 15.95s 23.66s
زمن الاستجابة (الحد الأقصى) 94.06s 166.72s
زمن الاستجابة (الإجمالي) 366.93s 544.16s
المعلمات ~120B الإجمالي (~5B النشطة) 180B الإجمالي (6B النشطة)
الإتاحة مغلق المصدر الأوزان متاحة

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-5.4 Nano

medium
التكلفة
$0.007
الوقت
24.6s
الرموز
4,943 tok

#96 Qwen3.8 Flash Next

low
التكلفة
~$0.002
الوقت
47.2s
الرموز
5,270 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147

مقارنة سريعة

تبديل زوج المقارنة

Gemini 3.8 FlashmediumvsQwen3.8 Flash NextlowQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 Ultramediumمتاح مجانًاvsQwen3.8 Flash NextlowGPT-5.4 MinimediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsGLM 5.3 FlashXmaxGPT-5.6 LunahighvsQwen3.8 Flash NextlowClaude Fable 5.1highvsGPT-5.4 NanomediumDeepSeek V4.1 FlashlowvsGPT-5.4 NanomediumGPT-5.4 NanomediumvsQwen3.7 MaxnoneGemini 3.5 FlashmediumvsQwen3.8 Flash NextlowDeepSeek V4 Flash 0423highvsGPT-5.4 Nanomedium