AI BENCHY Compare
MoonshotAI: Kimi K2.5 vs Elephant
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-14
| المقياس | Kimi K2.5 Kimi K2.5 none | Elephant Elephant medium |
|---|---|---|
| النتيجة | 5.5 | 5.2 |
| الترتيب | #72 | #77 |
| الاتساق | 8.7 | 9.6 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 40.7% | 29.6% |
| اختبارات غير مستقرة | 3 | 1 |
| إجمالي مرات التشغيل | 54 | 54 |
| التكلفة لكل نتيجة | 0.271 | 0.000 |
| إجمالي التكلفة | $0.017 | $0.000 |
| ??? ??????? | $0.383 / 1M | $0.000 / 1M |
| ??? ??????? | $1.720 / 1M | $0.000 / 1M |
| رموز الإخراج | 2,659 | 2,596 |
| رموز الاستدلال | 0 | 0 |
| زمن الاستجابة (المتوسط) | 13.37s | 1.27s |
| زمن الاستجابة (الحد الأقصى) | 42.13s | 3.70s |
| زمن الاستجابة (الإجمالي) | 147.05s | 22.82s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
ElephantmediumvsGrok 4.20noneMistral Small 4nonevsElephantmediumgpt-oss-120bnoneمتاح مجانًاvsElephantmediumTrinity Large Previewnoneمتاح مجانًاvsElephantmediumMistral Small 4mediumvsKimi K2.5noneGPT-5.4 MininonevsElephantmediumElephantmediumvsQwen3 Coder NextnoneMiniMax M2.5mediumمتاح مجانًاvsKimi K2.5noneNemotron 3 Supernoneمتاح مجانًاvsElephantmediumMiniMax M2.7mediumvsKimi K2.5noneElephantmediumvsGLM 5 TurbononeKimi K2.5nonevsgpt-oss-120bmediumمتاح مجانًا