التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.4 vs Z.ai: GLM 4.7 Flash

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-05

المقياس OpenAI: GPT-5.4 none الإصدار: 2026-03-05 Z.ai: GLM 4.7 Flash none الإصدار: 2026-01-19
الترتيب #44 #47
متوسط الدرجة 4.6 3.9
اختبارات صحيحة
الاتساق 8.9 8.3
التكلفة لكل نتيجة 1.496 0.064
إجمالي التكلفة $0.090 $0.003
معدل النجاح لكل محاولة 44.4% 37.8%
اختبارات غير مستقرة 2 3
common.totalAttempts 45 (15 x 3) 45 (15 x 3)
رموز الإخراج 1,635 1,721
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 1.46s 3.16s
زمن الاستجابة (الحد الأقصى) 2.89s 7.05s
زمن الاستجابة (الإجمالي) 21.86s 25.31s

أفضل النماذج حسب الدرجة

زمن الاستجابة (المتوسط)

الدرجة مقابل التكلفة الإجمالية

متوسط الدرجة vs زمن الاستجابة (المتوسط)

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.4 10.0 7.3 11.1% 1 1.41s 388 0
Z.ai: GLM 4.7 Flash 10.0 7.2 22.2% 1 6.59s 430 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.4 10.0 10.0 0.0% 0 2.89s 291 0
Z.ai: GLM 4.7 Flash 10.0 10.0 0.0% 0 3.22s 704 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.4 9.9 10.0 100.0% 0 1.04s 222 0
Z.ai: GLM 4.7 Flash 5.4 5.8 83.3% 1 4.82s 196 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.4 4.0 7.2 44.4% 1 1.07s 50 0
Z.ai: GLM 4.7 Flash 7.0 10.0 66.7% 0 744ms 19 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.4 5.5 10.0 50.0% 0 1.07s 81 0
Z.ai: GLM 4.7 Flash 5.5 10.0 50.0% 0 888ms 62 0
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.4 4.0 9.8 33.3% 0 1.52s 357 0
Z.ai: GLM 4.7 Flash 3.7 10.0 0.0% 0 1.00s 98 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 2.75s 246 0
Z.ai: GLM 4.7 Flash 10.0 1.6 33.3% 1 7.05s 212 0

مقارنة سريعة

تبديل زوج المقارنة