AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs Qwen: Qwen3.6 Max Preview

Сводка

Сравнение benchmark Kimi K2.5 vs Qwen3.6 Max Preview: Средний балл практически равен: 6.8 vs 6.9. Qwen3.6 Max Preview имеет более низкую стоимость benchmark: $0.075 vs $0.328. Qwen3.6 Max Preview быстрее: 3.30s vs 98.43s, с долей успешных попыток 68.3% vs 58.7%.

Рекомендуемая модель: Qwen3.6 Max Preview - Здесь у него лучший балл (6.9), при этом он примерно в 4.4 раза дешевле, чем Kimi K2.5.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-10

Метрика	Kimi K2.5 Kimi K2.5 medium Релиз: 2026-01-27	Qwen3.6 Max Preview Qwen3.6 Max Preview none Релиз: 2026-04-20

Метрика	Kimi K2.5 Kimi K2.5 medium Релиз: 2026-01-27	Qwen3.6 Max Preview Qwen3.6 Max Preview none Релиз: 2026-04-20
Оценка	6.8	6.9
Ранг	#77	#75
Надежность	10.0	10.0
Стабильность	6.9	9.2
Тестов верно
Доля успешных попыток	68.3%	58.7%
Нестабильные тесты	8	2
Всего запусков	63	63
Стоимость за результат	3.704	0.824
Общая стоимость	$0.328	$0.075
Цена входа	$0.400 / 1M	$1.040 / 1M
Цена выхода	$1.900 / 1M	$6.240 / 1M
Общее число входных токенов	34,312	42,509
Выходные токены	48,379	4,779
Токены рассуждений	157,747	0
Время ответа (среднее)	98.43s	3.30s
Время ответа (макс.)	281.00s	20.51s
Время ответа (суммарно)	1378.03s	69.40s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#77 MoonshotAI: Kimi K2.5

medium

Cost: $0.030
Time: 58.6s
Tokens: 8,683 tok

#75 Qwen3.6 Max Preview

none

Cost: $0.025
Time: 83.9s
Tokens: 4,066 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	7.3	5.8	83.3%	2		51.38s	634	2,789	8,880
Qwen3.6 Max Preview	5.2	7.9	41.7%	1		2.63s	696	513	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	6.1	4.6	66.7%	2		217.49s	6,935	5,705	74,693
Qwen3.6 Max Preview	3.8	7.3	22.2%	1		3.12s	7,913	456	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	10.0	10.0	100.0%	0		71.37s	11,280	703	3,713
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		20.51s	14,949	2,842	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	10.0	10.0	100.0%	0		49.78s	7,020	563	7,940
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		2.87s	7,794	243	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	3.5	4.4	33.3%	2		137.29s	485	20,753	30,564
Qwen3.6 Max Preview	7.7	10.0	66.7%	0		1.22s	789	18	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	6.5	3.4	66.7%	1		69.73s	480	3,815	4,262
Qwen3.6 Max Preview	4.3	10.0	0.0%	0		1.62s	522	76	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	10.0	10.0	100.0%	0		92.47s	675	5,371	6,547
Qwen3.6 Max Preview	9.8	10.0	100.0%	0		1.40s	711	69	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	5.3	7.3	44.4%	1		43.23s	659	8,426	12,692
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		2.65s	714	321	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	10.0	10.0	100.0%	0		31.74s	5,933	242	812
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		5.27s	8,211	222	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	3.0	10.0	0.0%	0		83.95s	211	12	7,644
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		1.97s	210	19	0

Быстрое сравнение

Сменить пару сравнения