AI BENCHY Compare
Elephant vs Z.ai: GLM 5.1
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-14
| المقياس | Elephant Elephant medium | GLM 5.1 GLM 5.1 none |
|---|---|---|
| النتيجة | 5.2 | 5.6 |
| الترتيب | #77 | #71 |
| الاتساق | 9.6 | 8.2 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 29.6% | 37.0% |
| اختبارات غير مستقرة | 1 | 4 |
| إجمالي مرات التشغيل | 54 | 54 |
| التكلفة لكل نتيجة | 0.000 | 1.046 |
| إجمالي التكلفة | $0.000 | $0.053 |
| ??? ??????? | $0.000 / 1M | $0.950 / 1M |
| ??? ??????? | $0.000 / 1M | $3.150 / 1M |
| رموز الإخراج | 2,596 | 3,720 |
| رموز الاستدلال | 0 | 0 |
| زمن الاستجابة (المتوسط) | 1.27s | 4.33s |
| زمن الاستجابة (الحد الأقصى) | 3.70s | 32.57s |
| زمن الاستجابة (الإجمالي) | 22.82s | 78.02s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
ElephantmediumvsGrok 4.20noneMistral Small 4nonevsElephantmediumgpt-oss-120bnoneمتاح مجانًاvsElephantmediumMistral Small 4mediumvsGLM 5.1noneTrinity Large Previewnoneمتاح مجانًاvsElephantmediumMiniMax M2.5mediumمتاح مجانًاvsGLM 5.1noneGPT-5.4 MininonevsElephantmediumElephantmediumvsQwen3 Coder NextnoneNemotron 3 Supernoneمتاح مجانًاvsElephantmediumgpt-oss-120bmediumمتاح مجانًاvsGLM 5.1noneElephantmediumvsGLM 5 TurbononeKimi K2.5nonevsElephantmedium