التنقل
Advertise here

GPT-5.4 (medium) vs Qwen3.8 27B (high)

يتقدم GPT-5.4 (medium) في متوسط النتيجة بـ 8.8 مقابل 8.7. لدى Qwen3.8 27B (high) تكلفة benchmark أقل عند ~$0.298 مقابل $2.006. GPT-5.4 (medium) أسرع عند 24.81s مقابل 166.34s، مع معدلات نجاح 78.3% مقابل 78.3%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-01

النماذج المقارنة

الترتيب
#50
إجمالي رموز الإخراج
96,502
زمن الاستجابة (المتوسط)
24.81s
إجمالي التكلفة
$2.006
الترتيب
#55
إجمالي رموز الإخراج
677,080
زمن الاستجابة (المتوسط)
166.34s
إجمالي التكلفة
~$0.298
النموذج الموصى به Qwen3.8 27B (high)

Its score stays close to the best score here (8.7 vs 8.8), while costing about 6.7x less than GPT-5.4 (medium).

مقارنة تفصيلية

المقياس GPT-5.4 GPT-5.4 medium الإصدار: 2026-03-05 Qwen3.8 27B Qwen3.8 27B high الإصدار: 2026-08-14 متاح مجانًا
النتيجة 8.8 8.7
الترتيب #50 #55
الموثوقية 10.0 9.7
الاتساق 8.7 9.2
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 78.3% 78.3%
اختبارات غير مستقرة 4 2
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 12.535 ~1.751
إجمالي التكلفة $2.006 ~$0.298
سعر الإدخال $2.500 / 1M غير متاح
سعر الإخراج $15.000 / 1M غير متاح
إجمالي رموز الإدخال 223,210 348,967
رموز الإخراج 7,312 1,005
رموز الاستدلال 89,190 676,075
زمن الاستجابة (المتوسط) 24.81s 166.34s
زمن الاستجابة (الحد الأقصى) 100.41s 640.85s
زمن الاستجابة (الإجمالي) 570.60s 3825.81s
المعلمات ~1.5T الإجمالي (~100B النشطة) 27.3B
الإتاحة مغلق المصدر الأوزان متاحة

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 GPT-5.4

medium
التكلفة
$0.214
الوقت
199.6s
الرموز
14,349 tok

#55 Qwen3.8 27B

high
التكلفة
~$0.008
الوقت
270.1s
الرموز
18,963 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

مقارنة سريعة

تبديل زوج المقارنة

GPT-5.2mediumvsQwen3.8 27Bhighمتاح مجانًاQwen3.8 27Bhighمتاح مجانًاvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27Bhighمتاح مجانًاGPT-6 SollowvsQwen3.8 27Bhighمتاح مجانًاGPT-5.4mediumvsQwen3.8 MAXlowDeepSeek V4.1 FlashhighvsGPT-5.4mediumDeepSeek V4.1 FlashmaxvsQwen3.8 27Bhighمتاح مجانًاMuse Spark 1.2lowvsQwen3.8 27Bhighمتاح مجانًاMuse Spark 1.2lowvsGPT-5.4mediumDeepSeek V4.1 FlashmediumvsQwen3.8 27Bhighمتاح مجانًاMuse Spark 1.1lowvsQwen3.8 27Bhighمتاح مجانًاClaude Sonnet 5.5xhighvsQwen3.8 27Bhighمتاح مجانًا