التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.4 (medium) vs Qwen3.6 Max Preview (medium)

متوسط النتيجة متقارب جدًا عند 8.5 مقابل 8.6. لدى Qwen3.6 Max Preview (medium) تكلفة benchmark أقل عند $1.132 مقابل $1.560. GPT-5.4 (medium) أسرع عند 22.85s مقابل 66.52s، مع معدلات نجاح 77.3% مقابل 83.3%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-09-02

الترتيب
#43
إجمالي رموز الإخراج
90,466
زمن الاستجابة (المتوسط)
22.85s
إجمالي التكلفة
$1.560
الترتيب
#41
إجمالي رموز الإخراج
170,373
زمن الاستجابة (المتوسط)
66.52s
إجمالي التكلفة
$1.132
النموذج الموصى به GPT-5.4 (medium)

It has the best score here (8.5), while responding about 2.9x faster than Qwen3.6 Max Preview (medium).

مقارنة تفصيلية

المقياس GPT-5.4 GPT-5.4 medium الإصدار: 2026-03-05 Qwen3.6 Max Preview Qwen3.6 Max Preview medium الإصدار: 2026-04-20
النتيجة 8.5 8.6
الترتيب #43 #41
الموثوقية 10.0 10.0
الاتساق 8.6 9.3
محاولات 66/66 66/66
اختبارات صحيحة
معدل النجاح لكل محاولة 77.3% 83.3%
اختبارات غير مستقرة 4 2
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 10.399 7.653
إجمالي التكلفة $1.560 $1.132
سعر الإدخال $2.500 / 1M $1.028 / 1M
سعر الإخراج $15.000 / 1M $6.162 / 1M
إجمالي رموز الإدخال 81,136 79,249
رموز الإخراج 6,155 5,097
رموز الاستدلال 84,311 165,276
زمن الاستجابة (المتوسط) 22.85s 66.52s
زمن الاستجابة (الحد الأقصى) 100.41s 238.07s
زمن الاستجابة (الإجمالي) 502.78s 1463.50s
المعلمات ~1.5T الإجمالي (~100B النشطة) ~1T الإجمالي (~40B النشطة)
الإتاحة مغلق المصدر مغلق المصدر

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#43 GPT-5.4

medium
التكلفة
$0.214
الوقت
199.6s
الرموز
14,349 tok

#41 Qwen3.6 Max Preview

medium
التكلفة
$0.024
الوقت
76.5s
الرموز
3,861 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957

مقارنة سريعة

تبديل زوج المقارنة