Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 (medium) vs Grok 4.20 (medium)

Средний балл практически равен: 7.0 vs 7.0. Kimi K2.5 (medium) имеет более низкую стоимость benchmark: $0.607 vs $0.805. Grok 4.20 (medium) быстрее: 32.56s vs 98.19s, с долей успешных попыток 63.6% vs 60.6%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-15

Ранг
#122
Общее число выходных токенов
220,942
Время ответа (среднее)
98.19s
Общая стоимость
$0.607
Ранг
#120
Общее число выходных токенов
270,259
Время ответа (среднее)
32.56s
Общая стоимость
$0.805
Рекомендуемая модель Grok 4.20 (medium)

Здесь у него лучший балл (7.0), и он отвечает примерно в 3.0 раза быстрее, чем Kimi K2.5 (medium).

Подробное сравнение

Метрика Kimi K2.5 Kimi K2.5 medium Релиз: 2026-01-27 Grok 4.20 Grok 4.20 medium Релиз: 2026-03-31
Оценка 7.0 7.0
Ранг #122 #120
Надежность 10.0 10.0
Стабильность 7.0 8.2
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 63.6% 60.6%
Нестабильные тесты 8 5
Всего запусков 66 66
Стоимость за результат 4.849 10.365
Общая стоимость $0.607 $0.805
Цена входа $0.571 / 1M $1.250 / 1M
Цена выхода $2.850 / 1M $2.500 / 1M
Общее число входных токенов 118,496 102,986
Выходные токены 53,522 5,860
Токены рассуждений 167,420 264,399
Время ответа (среднее) 98.19s 32.56s
Время ответа (макс.) 281.00s 199.66s
Время ответа (суммарно) 1571.05s 716.36s
Параметры 1T всего (32B активных) ~1T всего (~100B активных)
Доступность Веса доступны Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 MoonshotAI: Kimi K2.5

medium
Стоимость
$0.030
Время
58.6s
Токены
8,683 tok

#120 SpaceXAI: Grok 4.20

medium
Стоимость
$0.041
Время
110.3s
Токены
16,336 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

Быстрое сравнение

Сменить пару сравнения