Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs MoonshotAI: Kimi K2.5

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-29

Метрика Claude Sonnet 4.6 Claude Sonnet 4.6 none Релиз: 2026-02-17 Kimi K2.5 Kimi K2.5 medium Релиз: 2026-01-27
Оценка 7.0 6.7
Ранг #78 #85
Надежность 10.0 10.0
Стабильность 9.7 6.8
Тестов верно
Доля успешных попыток 58.3% 66.7%
Нестабильные тесты 1 8
Всего запусков 60 60
Стоимость за результат 2.782 3.486
Общая стоимость $0.306 $0.314
Цена входа $3.000 / 1M $0.400 / 1M
Цена выхода $15.000 / 1M $1.900 / 1M
Выходные токены 9,450 48,374
Токены рассуждений 0 128,473
Время ответа (среднее) 5.27s 89.02s
Время ответа (макс.) 23.84s 281.00s
Время ответа (суммарно) 68.50s 1157.32s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 1,214 0
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 2,789 8,880
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 6.8 10.0 50.0% 0 6.73s 2,112 0
Kimi K2.5 4.1 1.9 50.0% 2 215.89s 5,700 45,419
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 3,766 0
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 703 3,713
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 252 0
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 563 7,940
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 413 0
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 20,753 30,564
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 192 0
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 3,815 4,262
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 90 0
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 5,371 6,547
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.53s 533 0
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 8,426 12,692
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 447 0
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 242 812
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 431 0
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 12 7,644

Быстрое сравнение

Сменить пару сравнения