التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.6 Plus

الملخص

مقارنة benchmark بين GPT-5.4 Mini و Qwen3.6 Plus: يتقدم GPT-5.4 Mini في متوسط النتيجة بـ 8.0 مقابل 7.8. لدى Qwen3.6 Plus تكلفة benchmark أقل عند $0.294 مقابل $0.526. GPT-5.4 Mini أسرع عند 22.34s مقابل 30.70s، مع معدلات نجاح 73.0% مقابل 69.8%.

النموذج الموصى به: Qwen3.6 Plus - Its score stays close to the best score here (7.8 vs 8.0), while costing about 1.8x less than GPT-5.4 Mini.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-17

المقياس GPT-5.4 Mini GPT-5.4 Mini medium الإصدار: 2026-03-17 Qwen3.6 Plus Qwen3.6 Plus medium الإصدار: 2026-04-20
النتيجة 8.0 7.8
الترتيب #27 #30
الموثوقية 10.0 10.0
الاتساق 8.0 9.3
اختبارات صحيحة
معدل النجاح لكل محاولة 73.0% 69.8%
اختبارات غير مستقرة 5 2
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 4.381 0.831
إجمالي التكلفة $0.526 $0.294
سعر الإدخال $0.750 / 1M $0.325 / 1M
سعر الإخراج $4.500 / 1M $1.950 / 1M
إجمالي رموز الإدخال 34,116 41,565
رموز الإخراج 2,181 1,853
رموز الاستدلال 108,937 141,973
زمن الاستجابة (المتوسط) 22.34s 30.70s
زمن الاستجابة (الحد الأقصى) 138.75s 201.68s
زمن الاستجابة (الإجمالي) 469.20s 613.99s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#27 GPT-5.4 Mini

medium
Cost
$0.056
Time
95.5s
Tokens
12,464 tok

#30 Qwen3.6 Plus

medium
Cost
$0.024
Time
219.0s
Tokens
12,235 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 606 296 2,876
Qwen3.6 Plus 10.0 10.0 100.0% 0 9.90s 672 207 7,557
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 11,019 317 4,317
Qwen3.6 Plus 10.0 10.0 100.0% 0 34.95s 14,934 452 13,073
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 7,140 234 650
Qwen3.6 Plus 10.0 10.0 100.0% 0 14.95s 7,782 270 10,706
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 619 60 43,286
Qwen3.6 Plus 2.9 7.2 11.1% 1 29.59s 771 56 33,464
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 477 150 510
Qwen3.6 Plus 5.1 10.0 0.0% 0 27.05s 516 111 5,232
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 9.8 10.0 100.0% 0 2.13s 660 96 1,185
Qwen3.6 Plus 10.0 10.0 100.0% 0 7.54s 699 102 5,552
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 7.8 10.0 66.7% 0 4.37s 642 278 2,443
Qwen3.6 Plus 10.0 10.0 100.0% 0 6.34s 696 309 6,712
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 5,453 251 2,594
Qwen3.6 Plus 10.0 10.0 100.0% 0 5.87s 8,193 267 1,330
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT-5.4 Mini 3.0 10.0 0.0% 0 30.10s 195 32 10,174
Qwen3.6 Plus 3.0 10.0 0.0% 0 47.51s 204 21 7,761

مقارنة سريعة

تبديل زوج المقارنة