Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MoonshotAI: Kimi K2.6 vs Qwen: Qwen3.5 Plus 2026-04-20

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-22

Метрика Kimi K2.6 Kimi K2.6 medium Релиз: 2026-04-20 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Релиз: 2026-04-20
Оценка 7.4 7.6
Ранг #54 #42
Надежность 8.3 9.6
Стабильность 8.3 8.7
Тестов верно
Доля успешных попыток 70.8% 71.7%
Нестабильные тесты 4 3
Всего запусков 60 60
Стоимость за результат 7.630 2.789
Общая стоимость $0.916 $0.363
???? ????? $0.730 / 1M $0.300 / 1M
???? ?????? $3.490 / 1M $1.800 / 1M
Выходные токены 102,488 2,245
Токены рассуждений 229,389 150,235
Время ответа (среднее) 54.11s 43.63s
Время ответа (макс.) 215.85s 189.38s
Время ответа (суммарно) 1028.14s 872.61s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 7.0 8.0 66.7% 1 11.59s 7,115 8,934
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 10.84s 215 7,748
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 6.5 5.3 75.0% 1 118.23s 9,255 52,215
Qwen3.5 Plus 2026-04-20 5.4 6.0 66.7% 1 137.55s 287 42,318
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 10.0 10.0 100.0% 0 40.96s 711 13,876
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 92.41s 483 17,490
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 10.0 10.0 100.0% 0 20.38s 316 11,305
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 38.32s 270 14,668
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 5.3 7.2 44.4% 1 202.38s 47,035 98,262
Qwen3.5 Plus 2026-04-20 2.9 7.2 11.1% 1 53.10s 63 28,414
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 10.0 10.0 100.0% 0 17.83s 3,981 4,472
Qwen3.5 Plus 2026-04-20 4.9 9.6 0.0% 0 25.30s 125 4,792
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 10.0 10.0 100.0% 0 12.53s 3,977 5,269
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 20.25s 103 7,689
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 6.0 7.4 55.6% 1 25.59s 14,140 17,868
Qwen3.5 Plus 2026-04-20 8.2 7.2 88.9% 1 17.58s 324 9,786
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 10.0 10.0 100.0% 0 8.92s 248 1,011
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 14.72s 348 2,164
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.6 3.0 10.0 0.0% 0 130.27s 15,710 16,177
Qwen3.5 Plus 2026-04-20 3.0 10.0 0.0% 0 92.57s 27 15,166

Быстрое сравнение

Сменить пару сравнения