التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 Chat vs Qwen3.8 2.4T A95B (low)

يتقدم Qwen3.8 2.4T A95B (low) في متوسط النتيجة بـ 8.2 مقابل 8.0. لدى GPT-5.2 Chat تكلفة benchmark أقل عند $0.604 مقابل $3.113. GPT-5.2 Chat أسرع عند 7.65s مقابل 132.39s، مع معدلات نجاح 74.2% مقابل 78.8%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-08-12

الترتيب
#51
إجمالي رموز الإخراج
30,424
زمن الاستجابة (المتوسط)
7.65s
إجمالي التكلفة
$0.604
الترتيب
#46
إجمالي رموز الإخراج
554,485
زمن الاستجابة (المتوسط)
132.39s
إجمالي التكلفة
$3.113
النموذج الموصى به GPT-5.2 Chat

Its score stays close to the best score here (8.0 vs 8.2), while costing about 5.2x less than Qwen3.8 2.4T A95B (low).

مقارنة تفصيلية

المقياس GPT-5.2 Chat GPT-5.2 Chat none الإصدار: 2025-12-11 Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B low الإصدار: 2026-08-12
النتيجة 8.0 8.2
الترتيب #51 #46
الموثوقية 10.0 9.1
الاتساق 8.6 8.9
محاولات 66/66 66/66
اختبارات صحيحة
معدل النجاح لكل محاولة 74.2% 78.8%
اختبارات غير مستقرة 4 3
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 4.308 19.453
إجمالي التكلفة $0.604 $3.113
سعر الإدخال $1.750 / 1M $2.000 / 1M
سعر الإخراج $14.000 / 1M $6.000 / 1M
إجمالي رموز الإدخال 101,248 113,340
رموز الإخراج 30,424 107,311
رموز الاستدلال 0 447,174
زمن الاستجابة (المتوسط) 7.65s 132.39s
زمن الاستجابة (الحد الأقصى) 38.52s 534.21s
زمن الاستجابة (الإجمالي) 168.39s 2912.56s
المعلمات ~400B الإجمالي (~17B النشطة) 2.4T الإجمالي (95B النشطة)
الإتاحة مغلق المصدر الأوزان متاحة

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#51 GPT-5.2 Chat

none
التكلفة
$0.010
الوقت
15.3s
الرموز
797 tok

#46 Qwen3.8 2.4T A95B

low
التكلفة
$0.100
الوقت
193.2s
الرموز
16,767 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.8 2.4T A95B 7.6 7.2 77.8% 1 172.53s 6,716 21,405 57,399

مقارنة سريعة

تبديل زوج المقارنة