Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 2.5 Flash vs MoonshotAI: Kimi K2.6

Сводка

Сравнение benchmark Gemini 2.5 Flash vs Kimi K2.6: Gemini 2.5 Flash лидирует по среднему баллу: 6.2 vs 5.8. Gemini 2.5 Flash имеет более низкую стоимость benchmark: $0.016 vs $0.079. Gemini 2.5 Flash быстрее: 875ms vs 13.27s, с долей успешных попыток 46.0% vs 36.5%.

Рекомендуемая модель: Gemini 2.5 Flash - Здесь у него лучший балл (6.2), при этом он примерно в 5.2 раза дешевле, чем Kimi K2.6.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Gemini 2.5 Flash Gemini 2.5 Flash none Релиз: 2025-06-17 Kimi K2.6 Kimi K2.6 none Релиз: 2026-04-20 Бесплатно доступно
Оценка 6.2 5.8
Ранг #93 #111
Надежность 10.0 10.0
Стабильность 9.6 9.2
Тестов верно
Доля успешных попыток 46.0% 36.5%
Нестабильные тесты 1 2
Всего запусков 63 63
Стоимость за результат 0.169 1.267
Общая стоимость $0.016 $0.079
Цена входа $0.300 / 1M $0.680 / 1M
Цена выхода $2.500 / 1M $3.410 / 1M
Общее число входных токенов 35,926 32,916
Выходные токены 1,770 16,410
Токены рассуждений 0 0
Время ответа (среднее) 875ms 13.27s
Время ответа (макс.) 4.39s 238.89s
Время ответа (суммарно) 18.37s 278.57s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Gemini 2.5 Flash

none
Неверный SVG
Стоимость
$0.164
Время
215.5s
Токены
65,659 tok

#111 MoonshotAI: Kimi K2.6

none
Стоимость
$0.020
Время
127.4s
Токены
4,429 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 3.0 10.0 0.0% 0 582ms 492 102 0
Kimi K2.6 4.6 10.0 25.0% 0 1.39s 618 471 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 5.5 10.0 33.3% 0 736ms 8,122 483 0
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 3.0 10.0 0.0% 0 4.39s 12,519 366 0
Kimi K2.6 3.0 10.0 0.0% 0 3.38s 11,269 290 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 652ms 7,257 279 0
Kimi K2.6 10.0 10.0 100.0% 0 1.32s 7,014 201 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 5.9 7.2 55.6% 1 495ms 633 12 0
Kimi K2.6 5.3 7.2 44.4% 1 1.48s 732 42 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 5.0 10.0 0.0% 0 615ms 486 78 0
Kimi K2.6 5.4 3.5 33.3% 1 1.55s 477 138 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 590ms 615 72 0
Kimi K2.6 6.5 10.0 50.0% 0 1.64s 669 72 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 7.7 10.0 66.7% 0 604ms 558 132 0
Kimi K2.6 3.1 9.9 0.0% 0 1.40s 651 185 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 1.91s 5,088 234 0
Kimi K2.6 10.0 10.0 100.0% 0 4.46s 5,286 240 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 2.5 Flash 3.0 10.0 0.0% 0 1.15s 156 12 0
Kimi K2.6 3.0 10.0 0.0% 0 1.36s 214 17 0

Быстрое сравнение

Сменить пару сравнения