- Ранг
- #87
- Общее число выходных токенов
- 227,367
- Время ответа (среднее)
- 99.00s
- Общая стоимость
- $0.600
Kimi K2.5 (medium) vs Grok 4.3 (medium)
Grok 4.3 (medium) лидирует по среднему баллу: 7.1 vs 7.0. Kimi K2.5 (medium) имеет более низкую стоимость benchmark: $0.600 vs $0.779. Grok 4.3 (medium) быстрее: 47.45s vs 99.00s, с долей успешных попыток 65.2% vs 68.2%.
- Ранг
- #83
- Общее число выходных токенов
- 241,421
- Время ответа (среднее)
- 47.45s
- Общая стоимость
- $0.779
Рекомендуемая модель
Grok 4.3 (medium)
Здесь у него лучший балл (7.1), и он отвечает примерно в 2.1 раза быстрее, чем Kimi K2.5 (medium).
Подробное сравнение
| Метрика | Kimi K2.5 Kimi K2.5 medium | Grok 4.3 Grok 4.3 medium |
|---|---|---|
| Оценка | 7.0 | 7.1 |
| Ранг | #87 | #83 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 7.0 | 8.6 |
| Тестов верно | ||
| Доля успешных попыток | 65.2% | 68.2% |
| Нестабильные тесты | 8 | 4 |
| Всего запусков | 66 | 66 |
| Стоимость за результат | 4.789 | 5.990 |
| Общая стоимость | $0.600 | $0.779 |
| Цена входа | $0.571 / 1M | $1.250 / 1M |
| Цена выхода | $2.850 / 1M | $2.500 / 1M |
| Общее число входных токенов | 118,448 | 140,031 |
| Выходные токены | 62,124 | 13,739 |
| Токены рассуждений | 165,243 | 227,682 |
| Время ответа (среднее) | 99.00s | 47.45s |
| Время ответа (макс.) | 281.00s | 216.69s |
| Время ответа (суммарно) | 1485.04s | 1043.83s |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#87 MoonshotAI: Kimi K2.5
medium- Стоимость
- $0.030
- Время
- 58.6s
- Токены
- 8,683 tok
#83 xAI: Grok 4.3
medium- Стоимость
- $0.009
- Время
- 19.0s
- Токены
- 3,661 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
Быстрое сравнение
Сменить пару сравнения
Gemini 3.5 FlashnonevsKimi K2.5mediumQwen3.7 PlusnonevsGrok 4.3mediumDeepSeek V4 PrononevsKimi K2.5mediumKAT-Coder-Pro V2.5highvsGrok 4.3mediumKimi K2.5mediumvsGPT-5.6 SolnoneStep 3.7 FlashlowvsGrok 4.3mediumClaude Opus 4.8nonevsGrok 4.3mediumKimi K2.5mediumvsStep 3.7 FlashhighQwen3.7 FlashlowvsGrok 4.3mediumKimi K2.5mediumvsGPT-5.5noneGemini 3.5 FlashnonevsGrok 4.3mediumKimi K2.5mediumvsQwen3.7 Plusnone