AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs MoonshotAI: Kimi K2.6

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-20

Метрика	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Релиз: 2026-02-19	Kimi K2.6 Kimi K2.6 medium Релиз: 2026-04-20

Метрика	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Релиз: 2026-02-19	Kimi K2.6 Kimi K2.6 medium Релиз: 2026-04-20
Оценка	9.6	7.7
Ранг	#2	#34
Стабильность	10.0	8.3
Тестов верно
Доля успешных попыток	94.4%	74.1%
Нестабильные тесты	0	4
Всего запусков	54	54
Стоимость за результат	3.400	6.563
Общая стоимость	$0.578	$0.722
???? ?????	$2.000 / 1M	$0.950 / 1M
???? ??????	$12.000 / 1M	$4.000 / 1M
Выходные токены	1,932	80,759
Токены рассуждений	40,542	179,814
Время ответа (среднее)	15.96s	45.20s
Время ответа (макс.)	40.61s	215.85s
Время ответа (суммарно)	175.52s	768.37s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.90s	112	3,218
Kimi K2.6	7.0	8.0	66.7%	1		11.59s	7,115	8,934

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		19.88s	405	4,201
Kimi K2.6	10.0	10.0	100.0%	0		106.96s	3,236	18,817

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Pro Preview	9.5	10.0	100.0%	0		40.61s	432	9,281
Kimi K2.6	10.0	10.0	100.0%	0		40.96s	711	13,876

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.72s	279	3,904
Kimi K2.6	10.0	10.0	100.0%	0		20.38s	316	11,305

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Pro Preview	7.7	10.0	66.7%	0		32.73s	18	12,424
Kimi K2.6	5.3	7.2	44.4%	1		202.38s	47,035	98,262

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		11.77s	108	1,179
Kimi K2.6	10.0	10.0	100.0%	0		17.83s	3,981	4,472

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		9.56s	72	2,236
Kimi K2.6	10.0	10.0	100.0%	0		12.53s	3,977	5,269

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.15s	232	3,117
Kimi K2.6	5.0	5.2	44.5%	2		25.59s	14,140	17,868

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		23.15s	274	982
Kimi K2.6	10.0	10.0	100.0%	0		8.92s	248	1,011

Быстрое сравнение

Сменить пару сравнения

Kimi K2.6mediumvsGPT-5.3 Chatnone Gemini 3.1 Flash Lite PreviewnonevsKimi K2.6medium Kimi K2.6mediumvsGPT-5.2 Chatnone Claude Sonnet 4.6nonevsKimi K2.6medium Gemini 3.1 Flash Lite PreviewlowvsKimi K2.6medium Claude Opus 4.7nonevsGemini 3.1 Pro Previewmedium Gemini 3 Flash PreviewnonevsKimi K2.6medium Gemma 4 31BnoneБесплатно доступноvsKimi K2.6medium Kimi K2.6mediumvsQwen3.5 Plus 2026-02-15none Gemini 3 Flash PreviewlowvsKimi K2.6medium Kimi K2.6mediumvsGLM 5none Kimi K2.6mediumvsMiMo-V2-Omninone