AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-02-15 vs Xiaomi: MiMo-V2.5-Pro

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-22

Метрика	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none Релиз: 2026-02-15	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Релиз: 2026-04-22

Метрика	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none Релиз: 2026-02-15	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Релиз: 2026-04-22
Оценка	6.8	8.1
Ранг	#51	#23
Стабильность	9.3	8.8
Тестов верно
Доля успешных попыток	53.7%	75.9%
Нестабильные тесты	2	3
Всего запусков	54	54
Стоимость за результат	0.182	1.674
Общая стоимость	$0.017	$0.201
???? ?????	$0.260 / 1M	$1.000 / 1M
???? ??????	$1.560 / 1M	$3.000 / 1M
Выходные токены	2,461	2,735
Токены рассуждений	0	52,571
Время ответа (среднее)	2.60s	16.17s
Время ответа (макс.)	6.65s	84.22s
Время ответа (суммарно)	31.23s	291.09s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5 Plus 2026-02-15	4.8	10.0	25.0%	0		1.91s	517	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		2.95s	273	1,363

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5 Plus 2026-02-15	6.3	3.7	33.3%	1		3.63s	443	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		32.58s	543	7,485

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5 Plus 2026-02-15	3.0	10.0	0.0%	0		6.65s	314	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		53.36s	348	11,870

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		1.89s	243	0
MiMo-V2.5-Pro	7.3	5.8	83.3%	1		18.81s	260	8,383

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5 Plus 2026-02-15	5.3	10.0	33.3%	0		1.17s	17	0
MiMo-V2.5-Pro	5.3	10.0	33.3%	0		37.87s	275	17,023

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5 Plus 2026-02-15	4.4	3.0	33.3%	1		2.26s	117	0
MiMo-V2.5-Pro	5.1	3.3	33.3%	1		4.27s	150	549

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		1.67s	72	0
MiMo-V2.5-Pro	9.9	10.0	100.0%	0		2.77s	82	803

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5 Plus 2026-02-15	7.7	10.0	66.7%	0		2.82s	516	0
MiMo-V2.5-Pro	6.7	7.9	55.6%	1		5.16s	493	2,187

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		3.33s	222	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		16.87s	311	2,908

Быстрое сравнение

Сменить пару сравнения

Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2.5-Promedium Gemini 3 Flash PreviewnonevsMiMo-V2.5-Promedium Nemotron 3 SupermediumБесплатно доступноvsQwen3.5 Plus 2026-02-15none Qwen3.5 Plus 2026-02-15nonevsGrok 4.1 Fastmedium GPT-5.2 ChatnonevsMiMo-V2.5-Promedium Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2.5-Promedium Qwen3.5 Plus 2026-02-15nonevsGrok 4.20medium Kimi K2.5mediumvsQwen3.5 Plus 2026-02-15none GPT-5 MinimediumvsQwen3.5 Plus 2026-02-15none Mercury 2mediumvsQwen3.5 Plus 2026-02-15none GPT-5.3 ChatnonevsMiMo-V2.5-Promedium GPT-5.4 MinimediumvsQwen3.5 Plus 2026-02-15none