Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5-35B-A3B vs Xiaomi: MiMo-V2.5-Pro

Сводка

Сравнение benchmark Qwen3.5-35B-A3B vs MiMo-V2.5-Pro: Qwen3.5-35B-A3B лидирует по среднему баллу: 6.3 vs 5.5. MiMo-V2.5-Pro имеет более низкую стоимость benchmark: $0.017 vs $0.401. MiMo-V2.5-Pro быстрее: 1.78s vs 72.57s, с долей успешных попыток 69.8% vs 39.7%.

Рекомендуемая модель: MiMo-V2.5-Pro - Его балл близок к лучшему здесь (5.5 против 6.3), при этом он примерно в 25.0 раза дешевле, чем Qwen3.5-35B-A3B.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-02

Метрика Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Релиз: 2026-02-24 MiMo-V2.5-Pro MiMo-V2.5-Pro none Релиз: 2026-04-22
Оценка 6.3 5.5
Ранг #92 #123
Надежность 10.0 10.0
Стабильность 7.5 8.6
Тестов верно
Доля успешных попыток 69.8% 39.7%
Нестабильные тесты 6 4
Всего запусков 63 63
Стоимость за результат 5.162 0.648
Общая стоимость $0.401 $0.017
Цена входа $0.140 / 1M $0.435 / 1M
Цена выхода $1.000 / 1M $0.870 / 1M
Общее число входных токенов 42,196 30,724
Выходные токены 40,630 3,043
Токены рассуждений 353,577 0
Время ответа (среднее) 72.57s 1.78s
Время ответа (макс.) 409.98s 8.32s
Время ответа (суммарно) 1524.04s 37.42s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 Qwen3.5-35B-A3B

medium
Стоимость
$0.009
Время
71.4s
Токены
8,631 tok

#123 MiMo-V2.5-Pro

none
Стоимость
$0.004
Время
46.4s
Токены
4,025 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 672 798 42,652
MiMo-V2.5-Pro 3.3 8.1 8.3% 1 2.67s 645 994 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 20,992 775 12,485
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 3.54s 4,695 596 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 6,061 235 19,493
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 1.32s 7,758 249 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 500 41 46,368
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 877ms 753 27 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 172 20 3,753
MiMo-V2.5-Pro 4.0 10.0 0.0% 0 2.58s 498 87 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 699 97 17,361
MiMo-V2.5-Pro 6.4 10.0 50.0% 0 1.03s 684 66 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 8.2 7.2 88.9% 1 33.13s 597 3,592 26,585
MiMo-V2.5-Pro 6.7 4.7 77.8% 2 1.30s 678 267 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 8,193 309 1,365
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.30s 8,238 258 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 177.35s 204 10,919 72,053
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 1.89s 216 14 0

Быстрое сравнение

Сменить пару сравнения