AI BENCHY Compare
MoonshotAI: Kimi K2.5 vs xAI: Grok 4.20
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-22
| المقياس | Kimi K2.5 Kimi K2.5 none | Grok 4.20 Grok 4.20 none |
|---|---|---|
| النتيجة | 5.3 | 5.4 |
| الترتيب | #126 | #120 |
| الموثوقية | 10.0 | غير متاح |
| الاتساق | 8.9 | 9.5 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 36.7% | 35.2% |
| اختبارات غير مستقرة | 3 | 1 |
| إجمالي مرات التشغيل | 60 | 54 |
| التكلفة لكل نتيجة | 0.428 | 1.574 |
| إجمالي التكلفة | $0.026 | $0.095 |
| ??? ??????? | $0.400 / 1M | $1.250 / 1M |
| ??? ??????? | $1.900 / 1M | $2.500 / 1M |
| رموز الإخراج | 6,734 | 1,967 |
| رموز الاستدلال | 0 | 0 |
| زمن الاستجابة (المتوسط) | 14.16s | 1.11s |
| زمن الاستجابة (الحد الأقصى) | 42.13s | 6.04s |
| زمن الاستجابة (الإجمالي) | 184.10s | 20.02s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
Mistral Small 4mediumvsGrok 4.20noneMiniMax M2.5mediumمتاح مجانًاvsGrok 4.20noneElephant AlphamediumvsGrok 4.20noneKimi K2.5nonevsElephant AlphamediumMistral Small 4mediumvsKimi K2.5noneMiniMax M2.5mediumمتاح مجانًاvsKimi K2.5nonegpt-oss-120bmediumمتاح مجانًاvsGrok 4.20noneMiniMax M2.7mediumvsKimi K2.5noneKimi K2.5nonevsgpt-oss-120bmediumمتاح مجانًاCobuddymediumمتاح مجانًاvsGrok 4.20noneMiniMax M2.7mediumvsGrok 4.20noneOwl AlphamediumvsGrok 4.20none