AI BENCHY Compare
MoonshotAI: Kimi K2.5 vs xAI: Grok 4.20
Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-02
| Метрика | Kimi K2.5 Kimi K2.5 medium | Grok 4.20 Grok 4.20 medium |
|---|---|---|
| Оценка | 7.2 | 7.1 |
| Ранг | #39 | #40 |
| Стабильность | 7.2 | 8.2 |
| Тестов верно | ||
| Доля успешных попыток | 72.6% | 66.7% |
| Нестабильные тесты | 6 | 4 |
| Всего запусков | 51 | 51 |
| Стоимость за результат | 2.232 | 7.358 |
| Общая стоимость | $0.201 | $0.663 |
| ???? ????? | $0.383 / 1M | $2.000 / 1M |
| ???? ?????? | $1.909 / 1M | $6.000 / 1M |
| Выходные токены | 40,907 | 1,494 |
| Токены рассуждений | 75,121 | 97,078 |
| Время ответа (среднее) | 64.59s | 9.50s |
| Время ответа (макс.) | 137.29s | 29.87s |
| Время ответа (суммарно) | 645.93s | 161.54s |
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
Быстрое сравнение
Сменить пару сравнения
Claude Sonnet 4.6nonevsKimi K2.5mediumClaude Sonnet 4.6nonevsGrok 4.20mediumQwen3.5 Plus 2026-02-15nonevsGrok 4.20mediumKimi K2.5mediumvsGPT-5.3 ChatnoneGemma 4 31BnonevsGrok 4.20mediumGrok 4.20mediumvsGLM 5noneKimi K2.5mediumvsQwen3.5 Plus 2026-02-15noneGPT-5.3 ChatnonevsGrok 4.20mediumGemma 4 31BnonevsKimi K2.5mediumKimi K2.5mediumvsGLM 5noneKimi K2.5mediumvsGPT-5.2 ChatnoneGemini 3.1 Flash Lite PreviewnonevsKimi K2.5medium