التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5 Mini vs Qwen: Qwen3.5-Flash

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-03

المقياس OpenAI: GPT-5 Mini medium الإصدار: 2025-08-07 Qwen: Qwen3.5-Flash medium الإصدار: 2026-02-24
الترتيب #33 #32
متوسط الدرجة 5.77 5.79
الاتساق 8.79 7.60
التكلفة لكل نتيجة 1.200 0.650
إجمالي التكلفة $0.084 $0.046
اختبارات صحيحة
معدل النجاح لكل محاولة 57.1% 66.7%
اختبارات غير مستقرة 2 4
رموز الإخراج 4,723 1,194
رموز الاستدلال 35,392 108,368

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5 Mini 7.00 9.62 66.7% 0 1,645 5,824
Qwen: Qwen3.5-Flash 10.00 10.00 100.0% 0 363 23,645
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5 Mini 9.88 10.00 100.0% 0 453 3,200
Qwen: Qwen3.5-Flash 5.50 5.87 83.3% 1 235 16,237
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5 Mini 1.00 7.21 22.2% 1 293 14,016
Qwen: Qwen3.5-Flash 1.00 4.41 33.3% 2 52 34,605
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5 Mini 7.00 6.64 66.7% 1 318 4,992
Qwen: Qwen3.5-Flash 7.50 9.91 50.0% 0 98 14,139
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5 Mini 4.33 9.78 33.3% 0 1,527 5,760
Qwen: Qwen3.5-Flash 4.00 7.21 55.6% 1 137 18,458
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5 Mini 10.00 10.00 100.0% 0 487 1,600
Qwen: Qwen3.5-Flash 10.00 10.00 100.0% 0 309 1,284

مقارنة سريعة

تبديل زوج المقارنة