Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.6 Max Preview vs Xiaomi: MiMo-V2-Flash

Сводка

Сравнение benchmark Qwen3.6 Max Preview vs MiMo-V2-Flash: MiMo-V2-Flash лидирует по среднему баллу: 7.2 vs 6.9. MiMo-V2-Flash имеет более низкую стоимость benchmark: $0.043 vs $0.075. Qwen3.6 Max Preview быстрее: 3.30s vs 20.11s, с долей успешных попыток 58.7% vs 65.1%.

Рекомендуемая модель: Qwen3.6 Max Preview - Его балл близок к лучшему здесь (6.9 против 7.2), и он отвечает примерно в 6.1 раза быстрее, чем MiMo-V2-Flash.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-10

Метрика Qwen3.6 Max Preview Qwen3.6 Max Preview none Релиз: 2026-04-20 MiMo-V2-Flash MiMo-V2-Flash medium Релиз: 2025-12-16
Оценка 6.9 7.2
Ранг #75 #65
Надежность 10.0 10.0
Стабильность 9.2 8.8
Тестов верно
Доля успешных попыток 58.7% 65.1%
Нестабильные тесты 2 3
Всего запусков 63 63
Стоимость за результат 0.824 0.343
Общая стоимость $0.075 $0.043
Цена входа $1.040 / 1M $0.100 / 1M
Цена выхода $6.240 / 1M $0.300 / 1M
Общее число входных токенов 42,509 40,111
Выходные токены 4,779 12,476
Токены рассуждений 0 125,039
Время ответа (среднее) 3.30s 20.11s
Время ответа (макс.) 20.51s 96.01s
Время ответа (суммарно) 69.40s 301.59s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#75 Qwen3.6 Max Preview

none
Cost
$0.025
Time
83.9s
Tokens
4,066 tok

#65 MiMo-V2-Flash

medium
Invalid SVG
Cost
$0.020
Time
284.1s
Tokens
65,689 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 5.2 7.9 41.7% 1 2.63s 696 513 0
MiMo-V2-Flash 8.1 7.9 83.3% 1 15.85s 621 1,674 23,559
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0
MiMo-V2-Flash 6.0 7.2 55.6% 1 10.71s 7,177 474 13,505
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 20.51s 14,949 2,842 0
MiMo-V2-Flash 9.8 10.0 100.0% 0 75.68s 18,676 442 26,859
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.87s 7,794 243 0
MiMo-V2-Flash 6.5 10.0 50.0% 0 0ms 2,622 153 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 7.7 10.0 66.7% 0 1.22s 789 18 0
MiMo-V2-Flash 5.9 7.2 55.6% 1 96.01s 739 8,374 42,461
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 4.3 10.0 0.0% 0 1.62s 522 76 0
MiMo-V2-Flash 4.0 10.0 0.0% 0 4.20s 492 87 488
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 9.8 10.0 100.0% 0 1.40s 711 69 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 4.28s 678 75 3,504
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.65s 714 321 0
MiMo-V2-Flash 7.7 10.0 66.7% 0 3.87s 670 864 1,948
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 5.27s 8,211 222 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 27.78s 8,220 321 12,715
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 1.97s 210 19 0
MiMo-V2-Flash 3.0 10.0 0.0% 0 1.96s 216 12 0

Быстрое сравнение

Сменить пару сравнения