- Ранг
- #177
- Общее число выходных токенов
- 220,942
- Время ответа (среднее)
- 98.19s
- Общая стоимость
- $0.479
Kimi K2.5 (medium) vs Grok 4.20 (medium)
Средний балл практически равен: 7.0 vs 7.0. Kimi K2.5 (medium) имеет более низкую стоимость benchmark: $0.479 vs $0.805. Grok 4.20 (medium) быстрее: 32.56s vs 98.19s, с долей успешных попыток 63.6% vs 60.6%.
Сравниваемые модели
- Ранг
- #175
- Общее число выходных токенов
- 270,259
- Время ответа (среднее)
- 32.56s
- Общая стоимость
- $0.805
Рекомендуемая модель
Grok 4.20 (medium)
Здесь у него лучший балл (7.0), и он отвечает примерно в 3.0 раза быстрее, чем Kimi K2.5 (medium).
Подробное сравнение
| Метрика | Kimi K2.5 Kimi K2.5 medium | Grok 4.20 Grok 4.20 medium |
|---|---|---|
| Оценка | 7.0 | 7.0 |
| Ранг | #177 | #175 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 7.0 | 8.2 |
| Попытки | 66/66 | 66/66 |
| Тестов верно | ||
| Доля успешных попыток | 63.6% | 60.6% |
| Нестабильные тесты | 8 | 5 |
| Всего запусков | 66 | 66 |
| Стоимость за результат | 4.849 | 10.365 |
| Общая стоимость | $0.479 | $0.805 |
| Цена входа | $0.450 / 1M | $1.250 / 1M |
| Цена выхода | $2.250 / 1M | $2.500 / 1M |
| Общее число входных токенов | 118,496 | 102,986 |
| Выходные токены | 53,522 | 5,860 |
| Токены рассуждений | 167,420 | 264,399 |
| Время ответа (среднее) | 98.19s | 32.56s |
| Время ответа (макс.) | 281.00s | 199.66s |
| Время ответа (суммарно) | 1571.05s | 716.36s |
| Параметры | 1T всего (32B активных) | ~1T всего (~100B активных) |
| Доступность | Веса доступны | Закрытая модель |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#177 MoonshotAI: Kimi K2.5
medium- Стоимость
- $0.030
- Время
- 58.6s
- Токены
- 8,683 tok
#175 SpaceXAI: Grok 4.20
medium- Стоимость
- $0.041
- Время
- 110.3s
- Токены
- 16,336 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
Быстрое сравнение
Сменить пару сравнения
GPT-5.5nonevsGrok 4.20mediumSpace Bunny AlphahighvsGrok 4.20mediumKimi K2.5mediumvsGPT-5.5noneKimi K2.5mediumvsSpace Bunny AlphahighClaude Fable 5.1lowvsKimi K2.5mediumGPT-6 LunalowvsGrok 4.20mediumGPT-5.6 SolnonevsGrok 4.20mediumSeed-2.0-CodehighvsKimi K2.5mediumClaude Fable 5.1lowvsGrok 4.20mediumEmber-1highvsGrok 4.20mediumKimi K2.5mediumvsGPT-6 LunalowKimi K2.5mediumvsGPT-5.6 Solnone