AI BENCHY Compare

Qwen3.6 Plus Preview vs Xiaomi: MiMo-V2.5

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-22

Метрика	Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Релиз: 2026-03-30 Бесплатно доступно	MiMo-V2.5 MiMo-V2.5 none Релиз: 2026-04-22

Метрика	Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Релиз: 2026-03-30 Бесплатно доступно	MiMo-V2.5 MiMo-V2.5 none Релиз: 2026-04-22
Оценка	8.5	5.1
Ранг	#9	#92
Стабильность	10.0	10.0
Тестов верно
Доля успешных попыток	76.5%	27.8%
Нестабильные тесты	0	0
Всего запусков	49	54
Стоимость за результат	0.000	0.368
Общая стоимость	$0.000	$0.019
???? ?????	$0.000 / 1M	$0.400 / 1M
???? ??????	$0.000 / 1M	$2.000 / 1M
Выходные токены	1,756	2,177
Токены рассуждений	77,213	0
Время ответа (среднее)	13.94s	1.05s
Время ответа (макс.)	43.55s	2.43s
Время ответа (суммарно)	237.01s	18.94s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		9.90s	207	7,557
MiMo-V2.5	4.8	10.0	25.0%	0		842ms	232	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		34.95s	452	13,073
MiMo-V2.5	3.0	10.0	0.0%	0		2.36s	330	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		14.95s	270	10,706
MiMo-V2.5	6.5	10.0	50.0%	0		1.01s	366	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 Plus Preview	3.0	10.0	0.0%	0		22.08s	49	26,895
MiMo-V2.5	3.0	10.0	0.0%	0		756ms	27	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 Plus Preview	5.1	10.0	0.0%	0		27.05s	111	5,232
MiMo-V2.5	4.6	10.0	0.0%	0		841ms	97	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		7.54s	102	5,552
MiMo-V2.5	6.5	10.0	50.0%	0		751ms	72	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		6.11s	298	6,868
MiMo-V2.5	3.4	10.0	0.0%	0		731ms	162	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		5.87s	267	1,330
MiMo-V2.5	10.0	10.0	100.0%	0		2.43s	231	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 Plus Preview	-	-	-	-	-	-	-	-
MiMo-V2.5	10.0	10.0	100.0%	0		1.95s	660	0

Быстрое сравнение

Сменить пару сравнения

Elephant AlphamediumvsMiMo-V2.5none MiniMax M2.7mediumvsMiMo-V2.5none Gemini 3 Flash PreviewnonevsQwen3.6 Plus PreviewmediumБесплатно доступно Gemini 3 Flash PreviewlowvsQwen3.6 Plus PreviewmediumБесплатно доступно Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 Plus PreviewmediumБесплатно доступно Qwen3 Coder NextmediumvsMiMo-V2.5none MiMo-V2.5nonevsGLM 4.7 Flashmedium GPT-5.2 ChatnonevsQwen3.6 Plus PreviewmediumБесплатно доступно Gemini 3.1 Flash Lite PreviewnonevsQwen3.6 Plus PreviewmediumБесплатно доступно Mistral Small 4mediumvsMiMo-V2.5none MiniMax M2.5mediumБесплатно доступноvsMiMo-V2.5none Claude Opus 4.7nonevsQwen3.6 Plus PreviewmediumБесплатно доступно