AI BENCHY Compare
OpenAI: GPT-5.5 vs Z.ai: GLM 5
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-24
| المقياس | GPT-5.5 GPT-5.5 medium | GLM 5 GLM 5 medium |
|---|---|---|
| النتيجة | 9.0 | 8.4 |
| الترتيب | #5 | #15 |
| الموثوقية | غير متاح | غير متاح |
| الاتساق | 9.2 | 8.2 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 87.0% | 85.2% |
| اختبارات غير مستقرة | 2 | 4 |
| إجمالي مرات التشغيل | 54 | 54 |
| التكلفة لكل نتيجة | 19.226 | 1.188 |
| إجمالي التكلفة | $2.884 | $0.155 |
| ??? ??????? | $5.000 / 1M | $0.600 / 1M |
| ??? ??????? | $30.000 / 1M | $2.080 / 1M |
| رموز الإخراج | 1,920 | 20,163 |
| رموز الاستدلال | 89,632 | 58,337 |
| زمن الاستجابة (المتوسط) | 32.75s | 23.34s |
| زمن الاستجابة (الحد الأقصى) | 332.10s | 79.09s |
| زمن الاستجابة (الإجمالي) | 589.59s | 233.40s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
HY3 Previewhighمتاح مجانًاvsGLM 5mediumGemini 3 Flash PreviewlowvsGPT-5.5mediumClaude Opus 4.7nonevsGPT-5.5mediumHY3 Previewlowمتاح مجانًاvsGLM 5mediumGemini 3 Flash PreviewnonevsGLM 5mediumGemini 3.1 Flash Lite PreviewlowvsGLM 5mediumGemini 3 Flash PreviewlowvsGLM 5mediumGPT-5.2 ChatnonevsGLM 5mediumGemini 3.1 Flash Lite PreviewnonevsGLM 5mediumGPT-5.5mediumvsHY3 Previewhighمتاح مجانًاDeepSeek V4 FlashhighvsGLM 5mediumGPT-5.3 ChatnonevsGLM 5medium