التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs Z.ai: GLM 4.7 Flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-29

المقياس Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium الإصدار: 2026-02-19 GLM 4.7 Flash GLM 4.7 Flash none الإصدار: 2026-01-19
النتيجة 9.6 5.6
الترتيب #2 #97
الموثوقية غير متاح غير متاح
الاتساق 10.0 8.6
اختبارات صحيحة
معدل النجاح لكل محاولة 94.4% 37.0%
اختبارات غير مستقرة 0 3
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 3.400 0.059
إجمالي التكلفة $0.578 $0.003
??? ??????? $2.000 / 1M $0.060 / 1M
??? ??????? $12.000 / 1M $0.400 / 1M
رموز الإخراج 1,932 2,489
رموز الاستدلال 40,542 0
زمن الاستجابة (المتوسط) 15.96s 3.35s
زمن الاستجابة (الحد الأقصى) 40.61s 7.05s
زمن الاستجابة (الإجمالي) 175.52s 36.90s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.90s 112 3,218
GLM 4.7 Flash 5.2 7.9 41.7% 1 5.51s 438 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 19.88s 405 4,201
GLM 4.7 Flash 6.4 9.9 0.0% 0 5.57s 626 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Pro Preview 9.5 10.0 100.0% 0 40.61s 432 9,281
GLM 4.7 Flash 3.0 10.0 0.0% 0 3.22s 704 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.72s 279 3,904
GLM 4.7 Flash 7.3 5.8 83.3% 1 4.82s 196 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Pro Preview 7.7 10.0 66.7% 0 32.73s 18 12,424
GLM 4.7 Flash 7.7 10.0 66.7% 0 744ms 19 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 108 1,179
GLM 4.7 Flash 4.0 10.0 0.0% 0 1.59s 134 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 72 2,236
GLM 4.7 Flash 6.5 10.0 50.0% 0 888ms 62 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.15s 232 3,117
GLM 4.7 Flash 4.4 10.0 0.0% 0 1.00s 98 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 274 982
GLM 4.7 Flash 2.8 1.6 33.3% 1 7.05s 212 0

مقارنة سريعة

تبديل زوج المقارنة