Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-35B-A3B vs Xiaomi: MiMo-V2-Omni

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-22

Метрика Qwen3.5-35B-A3B Qwen3.5-35B-A3B none Релиз: 2026-02-24 MiMo-V2-Omni MiMo-V2-Omni none Релиз: 2026-03-18
Оценка 5.8 6.2
Ранг #102 #93
Надежность 10.0 10.0
Стабильность 8.9 9.7
Тестов верно
Доля успешных попыток 45.0% 41.7%
Нестабильные тесты 3 1
Всего запусков 60 52
Стоимость за результат 0.224 0.288
Общая стоимость $0.016 $0.023
???? ????? $0.139 / 1M $0.400 / 1M
???? ?????? $1.000 / 1M $2.000 / 1M
Выходные токены 4,334 3,314
Токены рассуждений 0 0
Время ответа (среднее) 3.50s 2.44s
Время ответа (макс.) 47.43s 6.81s
Время ответа (суммарно) 69.99s 48.81s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 3.4 7.9 16.7% 1 1.43s 574 0
MiMo-V2-Omni 3.6 8.4 8.3% 1 1.63s 773 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 6.8 10.0 50.0% 0 1.72s 562 0
MiMo-V2-Omni 5.1 10.0 0.0% 0 2.75s 1,459 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 47.43s 1,833 0
MiMo-V2-Omni 3.0 10.0 0.0% 0 5.96s 387 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 1.16s 243 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 1.76s 147 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 7.7 10.0 66.7% 0 485ms 15 0
MiMo-V2-Omni 5.3 10.0 33.3% 0 2.10s 24 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 6.5 3.4 66.7% 1 1.19s 114 0
MiMo-V2-Omni 4.1 10.0 0.0% 0 2.33s 103 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 6.3 10.0 50.0% 0 809ms 63 0
MiMo-V2-Omni 6.5 10.0 50.0% 0 4.26s 30 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 3.7 7.4 22.2% 1 1.34s 655 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 1.16s 148 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 2.30s 264 0
MiMo-V2-Omni 10.0 10.0 100.0% 0 5.40s 231 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 493ms 11 0
MiMo-V2-Omni 3.0 10.0 0.0% 0 1.30s 12 0

Быстрое сравнение

Сменить пару сравнения