Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5-35B-A3B vs Xiaomi: MiMo-V2-Omni

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-29

Метрика Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Релиз: 2026-02-24 MiMo-V2-Omni MiMo-V2-Omni medium Релиз: 2026-03-18
Оценка 7.3 6.9
Ранг #68 #81
Надежность 10.0 10.0
Стабильность 7.5 8.7
Тестов верно
Доля успешных попыток 73.3% 58.3%
Нестабильные тесты 6 3
Всего запусков 60 52
Стоимость за результат 4.865 7.334
Общая стоимость $0.536 $0.734
Цена входа $0.139 / 1M $0.400 / 1M
Цена выхода $1.000 / 1M $2.000 / 1M
Выходные токены 31,242 1,952
Токены рассуждений 330,546 357,306
Время ответа (среднее) 69.66s 41.16s
Время ответа (макс.) 409.98s 299.23s
Время ответа (суммарно) 1393.17s 823.26s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 798 42,652
MiMo-V2-Omni 10.0 10.0 100.0% 0 2.75s 269 1,701
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 6.5 10.0 50.0% 0 244.54s 14,456 88,431
MiMo-V2-Omni 3.4 4.8 16.7% 1 183.89s 292 174,314
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 775 12,485
MiMo-V2-Omni 10.0 10.0 100.0% 0 25.87s 380 8,673
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 235 19,493
MiMo-V2-Omni 10.0 10.0 100.0% 0 3.04s 155 591
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 41 46,368
MiMo-V2-Omni 3.0 10.0 0.0% 0 47.89s 155 68,398
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 20 3,753
MiMo-V2-Omni 5.4 2.5 66.7% 1 3.61s 136 492
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 97 17,361
MiMo-V2-Omni 8.3 10.0 50.0% 0 4.99s 49 515
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 8.2 7.2 88.9% 1 33.13s 3,592 26,585
MiMo-V2-Omni 5.9 7.2 55.6% 1 2.38s 210 860
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 309 1,365
MiMo-V2-Omni 10.0 10.0 100.0% 0 13.98s 303 3,461
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 177.35s 10,919 72,053
MiMo-V2-Omni 3.0 10.0 0.0% 0 234.19s 3 98,301

Быстрое сравнение

Сменить пару сравнения