Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.7 Plus vs Xiaomi: MiMo-V2.5

Сводка

Сравнение benchmark Qwen3.7 Plus vs MiMo-V2.5: Qwen3.7 Plus лидирует по среднему баллу: 7.2 vs 6.7. Qwen3.7 Plus имеет более низкую стоимость benchmark: $0.023 vs $0.063. Qwen3.7 Plus быстрее: 2.85s vs 27.11s, с долей успешных попыток 47.6% vs 69.8%.

Рекомендуемая модель: Qwen3.7 Plus - Здесь у него лучший балл (7.2), при этом он примерно в 2.8 раза дешевле, чем MiMo-V2.5.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Qwen3.7 Plus Qwen3.7 Plus none Релиз: 2026-06-03 MiMo-V2.5 MiMo-V2.5 medium Релиз: 2026-04-22
Оценка 7.2 6.7
Ранг #60 #76
Надежность 10.0 10.0
Стабильность 10.0 8.1
Тестов верно
Доля успешных попыток 47.6% 69.8%
Нестабильные тесты 0 5
Всего запусков 63 63
Стоимость за результат 0.276 2.966
Общая стоимость $0.023 $0.063
Цена входа $0.320 / 1M $0.140 / 1M
Цена выхода $1.280 / 1M $0.280 / 1M
Общее число входных токенов 42,510 41,838
Выходные токены 6,578 2,827
Токены рассуждений 0 198,898
Время ответа (среднее) 2.85s 27.11s
Время ответа (макс.) 29.38s 162.44s
Время ответа (суммарно) 59.86s 569.38s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 Qwen3.7 Plus

none
Стоимость
$0.019
Время
213.5s
Токены
11,960 tok

#76 MiMo-V2.5

medium
Стоимость
$0.002
Время
54.8s
Токены
5,247 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 6.5 10.0 50.0% 0 1.38s 696 349 0
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 10.0 10.0 100.0% 0 29.38s 14,952 4,505 0
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 10.0 10.0 100.0% 0 1.43s 7,794 243 0
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 3.0 10.0 0.0% 0 868ms 789 18 0
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 5.3 10.0 0.0% 0 1.33s 522 78 0
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 6.3 10.0 50.0% 0 929ms 711 72 0
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 7.7 10.0 66.7% 0 1.71s 714 443 0
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 10.0 10.0 100.0% 0 3.54s 8,211 222 0
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.7 Plus 3.0 10.0 0.0% 0 1.21s 210 9 0
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

Быстрое сравнение

Сменить пару сравнения