التنقل
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (high) vs Qwen3.8 Flash Next (low)

متوسط النتيجة متقارب جدًا عند 8.0 مقابل 8.0. لدى Qwen3.8 Flash Next (low) تكلفة benchmark أقل عند ~$0.045 مقابل $0.118. GPT-5.6 Luna (high) أسرع عند 18.39s مقابل 23.66s، مع معدلات نجاح 71.0% مقابل 79.7%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-05

النماذج المقارنة

الترتيب
#92
إجمالي رموز الإخراج
139,395
زمن الاستجابة (المتوسط)
18.39s
إجمالي التكلفة
$0.118
الترتيب
#96
إجمالي رموز الإخراج
135,295
زمن الاستجابة (المتوسط)
23.66s
إجمالي التكلفة
~$0.045
النموذج الموصى به Qwen3.8 Flash Next (low)

It has the best score here (8.0), while costing about 2.6x less than GPT-5.6 Luna (high).

مقارنة تفصيلية

المقياس GPT-5.6 Luna GPT-5.6 Luna high الإصدار: 2026-07-09 Qwen3.8 Flash Next Qwen3.8 Flash Next low الإصدار: 2026-10-04
النتيجة 8.0 8.0
الترتيب #92 #96
الموثوقية 10.0 10.0
الاتساق 8.6 8.0
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 71.0% 79.7%
اختبارات غير مستقرة 4 6
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 5.882 ~0.299
إجمالي التكلفة $0.118 ~$0.045
سعر الإدخال $0.200 / 1M غير متاح
سعر الإخراج $1.200 / 1M غير متاح
سعر قراءة ذاكرة التخزين المؤقت $0.020 / 1M غير متاح
سعر الكتابة في ذاكرة التخزين المؤقت $0.250 / 1M غير متاح
إجمالي رموز الإدخال 197,896 342,163
رموز الإخراج 6,211 1,518
رموز الاستدلال 133,184 133,777
زمن الاستجابة (المتوسط) 18.39s 23.66s
زمن الاستجابة (الحد الأقصى) 111.09s 166.72s
زمن الاستجابة (الإجمالي) 422.93s 544.16s
المعلمات ~400B الإجمالي (~17B النشطة) 180B الإجمالي (6B النشطة)
الإتاحة مغلق المصدر الأوزان متاحة

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 GPT-5.6 Luna

high
التكلفة
$0.033
الوقت
34.2s
الرموز
5,484 tok

#96 Qwen3.8 Flash Next

low
التكلفة
~$0.002
الوقت
47.2s
الرموز
5,270 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147

مقارنة سريعة

تبديل زوج المقارنة

Nemotron 3 Ultramediumمتاح مجانًاvsGPT-5.6 LunahighGemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowDeepSeek V4.1 FlashlowvsGPT-5.6 LunahighQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxGemini 3.8 FlashmediumvsGPT-5.6 LunahighClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 Ultramediumمتاح مجانًاvsQwen3.8 Flash NextlowGPT-5.4 MinimediumvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsGPT-5.6 LunahighGPT-5.6 LunahighvsQwen3.5-27BmediumGPT-5.6 LunahighvsGLM 5.3 FlashXmax