التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-02

المقياس GPT-5.4 Nano GPT-5.4 Nano none الإصدار: 2026-03-17 GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT none الإصدار: تاريخ الإصدار غير معروف
النتيجة 4.3 3.0
الترتيب #86 #88
الاتساق 7.3 10.0
اختبارات صحيحة
معدل النجاح لكل محاولة 29.4% 0.0%
اختبارات غير مستقرة 6 0
إجمالي مرات التشغيل 51 48
التكلفة لكل نتيجة 0.404 0.000
إجمالي التكلفة $0.009 $0.000
??? ??????? $0.200 / 1M $0.000 / 1M
??? ??????? $1.250 / 1M $0.000 / 1M
رموز الإخراج 2,185 0
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 1.39s 0ms
زمن الاستجابة (الحد الأقصى) 3.84s 0ms
زمن الاستجابة (الإجمالي) 23.70s 0ms

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 3.5 8.0 16.7% 1 1.18s 800 0
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 3.0 10.0 0.0% 0 3.84s 280 0
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 6.5 10.0 50.0% 0 1.11s 219 0
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 2.9 4.4 22.2% 2 926ms 52 0
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 3.8 2.5 33.3% 1 1.31s 180 0
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 5.0 6.8 33.3% 1 787ms 84 0
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 3.7 7.3 22.2% 1 1.29s 348 0
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5.4 Nano 10.0 10.0 100.0% 0 3.40s 222 0
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT 3.0 10.0 0.0% 0 0ms 0 0

مقارنة سريعة

تبديل زوج المقارنة