AI BENCHY Compare

Qwen: Qwen3.7 Plus vs Xiaomi: MiMo-V2.5

Сводка

Сравнение benchmark Qwen3.7 Plus vs MiMo-V2.5: Qwen3.7 Plus лидирует по среднему баллу: 7.2 vs 6.7. Qwen3.7 Plus имеет более низкую стоимость benchmark: $0.023 vs $0.063. Qwen3.7 Plus быстрее: 2.85s vs 27.11s, с долей успешных попыток 47.6% vs 69.8%.

Рекомендуемая модель: Qwen3.7 Plus - Здесь у него лучший балл (7.2), при этом он примерно в 2.8 раза дешевле, чем MiMo-V2.5.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика	Qwen3.7 Plus Qwen3.7 Plus none Релиз: 2026-06-03	MiMo-V2.5 MiMo-V2.5 medium Релиз: 2026-04-22

Метрика	Qwen3.7 Plus Qwen3.7 Plus none Релиз: 2026-06-03	MiMo-V2.5 MiMo-V2.5 medium Релиз: 2026-04-22
Оценка	7.2	6.7
Ранг	#60	#76
Надежность	10.0	10.0
Стабильность	10.0	8.1
Тестов верно
Доля успешных попыток	47.6%	69.8%
Нестабильные тесты	0	5
Всего запусков	63	63
Стоимость за результат	0.276	2.966
Общая стоимость	$0.023	$0.063
Цена входа	$0.320 / 1M	$0.140 / 1M
Цена выхода	$1.280 / 1M	$0.280 / 1M
Общее число входных токенов	42,510	41,838
Выходные токены	6,578	2,827
Токены рассуждений	0	198,898
Время ответа (среднее)	2.85s	27.11s
Время ответа (макс.)	29.38s	162.44s
Время ответа (суммарно)	59.86s	569.38s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 Qwen3.7 Plus

none

Стоимость: $0.019
Время: 213.5s
Токены: 11,960 tok

#76 MiMo-V2.5

medium

Стоимость: $0.002
Время: 54.8s
Токены: 5,247 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	6.5	10.0	50.0%	0		1.38s	696	349	0
MiMo-V2.5	10.0	10.0	100.0%	0		4.14s	621	281	1,739

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	5.5	10.0	33.3%	0		2.15s	7,911	639	0
MiMo-V2.5	6.2	4.7	66.7%	2		97.14s	7,422	557	81,977

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	10.0	10.0	100.0%	0		29.38s	14,952	4,505	0
MiMo-V2.5	10.0	10.0	100.0%	0		16.86s	15,060	363	7,609

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	10.0	10.0	100.0%	0		1.43s	7,794	243	0
MiMo-V2.5	2.7	5.7	16.7%	1		6.33s	7,746	306	5,714

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	3.0	10.0	0.0%	0		868ms	789	18	0
MiMo-V2.5	5.3	10.0	33.3%	0		34.53s	735	507	49,478

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	5.3	10.0	0.0%	0		1.33s	522	78	0
MiMo-V2.5	5.4	2.5	66.7%	1		5.37s	492	121	418

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	6.3	10.0	50.0%	0		929ms	711	72	0
MiMo-V2.5	9.9	10.0	100.0%	0		1.80s	672	88	801

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	7.7	10.0	66.7%	0		1.71s	714	443	0
MiMo-V2.5	8.2	7.2	88.9%	1		20.25s	660	279	33,254

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	10.0	10.0	100.0%	0		3.54s	8,211	222	0
MiMo-V2.5	10.0	10.0	100.0%	0		7.29s	8,220	303	2,424

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.7 Plus	3.0	10.0	0.0%	0		1.21s	210	9	0
MiMo-V2.5	3.0	10.0	0.0%	0		51.29s	210	22	15,484

Быстрое сравнение

Сменить пару сравнения

Gemma 4 26B A4BmediumБесплатно доступноvsQwen3.7 Plusnone Qwen3.7 PlusnonevsStep 3.7 Flashhigh Qwen3.7 PlusnonevsGLM 5.1medium Gemini 3.5 FlashminimalvsMiMo-V2.5medium Qwen3.7 MaxnonevsMiMo-V2.5medium Kimi K2.7 CodemediumvsQwen3.7 Plusnone Qwen3.7 PlusnonevsGrok 4.20medium Gemini 3 Flash PreviewnonevsMiMo-V2.5medium Gemini 3 Flash PreviewlowvsQwen3.7 Plusnone Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2.5medium Qwen3.7 PlusnonevsMiMo-V2.5-Promedium Seed-2.0-MinimediumvsQwen3.7 Plusnone