Навигация
AI BENCHY
Advertise here

Anthropic: Claude Sonnet 4.6 vs MoonshotAI: Kimi K2.5

Claude Sonnet 4.6 лидирует по среднему баллу: 7.3 vs 7.0. Kimi K2.5 (medium) имеет более низкую стоимость benchmark: $0.600 vs $0.661. Claude Sonnet 4.6 быстрее: 8.12s vs 99.00s, с долей успешных попыток 57.6% vs 65.2%.

Рекомендуемая модельClaude Sonnet 4.6Здесь у него лучший балл (7.3), и он отвечает примерно в 12.2 раза быстрее, чем Kimi K2.5 (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика Claude Sonnet 4.6 Claude Sonnet 4.6 none Релиз: 2026-02-17 Kimi K2.5 Kimi K2.5 medium Релиз: 2026-01-27
Оценка 7.3 7.0
Ранг #71 #85
Надежность 10.0 10.0
Стабильность 9.7 7.0
Тестов верно
Доля успешных попыток 57.6% 65.2%
Нестабильные тесты 1 8
Всего запусков 66 66
Стоимость за результат 5.502 4.789
Общая стоимость $0.661 $0.600
Цена входа $3.000 / 1M $0.571 / 1M
Цена выхода $15.000 / 1M $2.850 / 1M
Общее число входных токенов 123,264 118,448
Выходные токены 19,362 62,124
Токены рассуждений 0 165,243
Время ответа (среднее) 8.12s 99.00s
Время ответа (макс.) 51.18s 281.00s
Время ответа (суммарно) 121.78s 1485.04s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Sonnet 4.6

none
Стоимость
$0.038
Время
27.3s
Токены
2,598 tok

#85 MoonshotAI: Kimi K2.5

medium
Стоимость
$0.030
Время
58.6s
Токены
8,683 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693

Быстрое сравнение

Сменить пару сравнения