AI BENCHY Compare
Xiaomi: MiMo-V2.5 vs Z.ai: GLM 5
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-22
| المقياس | MiMo-V2.5 MiMo-V2.5 medium | GLM 5 GLM 5 none |
|---|---|---|
| النتيجة | 7.8 | 6.6 |
| الترتيب | #35 | #55 |
| الاتساق | 8.6 | 9.6 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 74.1% | 51.9% |
| اختبارات غير مستقرة | 3 | 1 |
| إجمالي مرات التشغيل | 54 | 54 |
| التكلفة لكل نتيجة | 2.102 | 0.217 |
| إجمالي التكلفة | $0.253 | $0.020 |
| ??? ??????? | $0.400 / 1M | $0.650 / 1M |
| ??? ??????? | $2.000 / 1M | $2.080 / 1M |
| رموز الإخراج | 2,840 | 1,959 |
| رموز الاستدلال | 116,242 | 0 |
| زمن الاستجابة (المتوسط) | 13.71s | 4.23s |
| زمن الاستجابة (الحد الأقصى) | 86.93s | 11.07s |
| زمن الاستجابة (الإجمالي) | 246.73s | 46.51s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
Grok 4.1 FastmediumvsGLM 5noneNemotron 3 Supermediumمتاح مجانًاvsGLM 5noneGPT-5.3 ChatnonevsMiMo-V2.5mediumMercury 2mediumvsGLM 5noneGemini 3.1 Flash Lite PreviewnonevsMiMo-V2.5mediumGPT-5.2 ChatnonevsMiMo-V2.5mediumGrok 4.20mediumvsGLM 5noneClaude Sonnet 4.6nonevsMiMo-V2.5mediumGemini 3.1 Flash Lite PreviewlowvsMiMo-V2.5mediumKimi K2.5mediumvsGLM 5noneGemini 3 Flash PreviewnonevsMiMo-V2.5mediumGPT-5 MinimediumvsGLM 5none