Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5 Mini vs Xiaomi: MiMo-V2-Flash

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-16

Метрика GPT-5 Mini GPT-5 Mini medium Релиз: 2025-08-07 MiMo-V2-Flash MiMo-V2-Flash medium Релиз: 2025-12-16
Оценка 7.0 7.5
Ранг #44 #40
Стабильность 8.6 8.6
Тестов верно
Доля успешных попыток 61.1% 70.4%
Нестабильные тесты 3 3
Всего запусков 54 54
Стоимость за результат 1.415 0.341
Общая стоимость $0.128 $0.038
???? ????? $0.250 / 1M $0.090 / 1M
???? ?????? $2.000 / 1M $0.290 / 1M
Выходные токены 6,379 12,387
Токены рассуждений 53,482 115,182
Время ответа (среднее) 23.98s 23.36s
Время ответа (макс.) 88.15s 96.01s
Время ответа (суммарно) 431.56s 280.34s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Mini 7.1 7.6 66.7% 1 13.86s 1,715 6,378
MiMo-V2-Flash 8.1 7.9 83.3% 1 15.85s 1,674 23,559
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Mini 10.0 10.0 100.0% 0 23.18s 483 4,160
MiMo-V2-Flash 4.7 1.6 66.7% 1 13.03s 428 3,648
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Mini 10.0 10.0 100.0% 0 88.15s 754 11,520
MiMo-V2-Flash 9.8 10.0 100.0% 0 75.68s 442 26,859
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Mini 10.0 10.0 100.0% 0 12.58s 453 3,200
MiMo-V2-Flash 6.5 10.0 50.0% 0 0ms 153 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Mini 3.6 7.2 22.2% 1 44.63s 293 14,016
MiMo-V2-Flash 5.9 7.2 55.6% 1 96.01s 8,374 42,461
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Mini 4.5 10.0 0.0% 0 13.50s 349 1,856
MiMo-V2-Flash 4.0 10.0 0.0% 0 4.20s 87 488
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Mini 8.0 6.6 83.3% 1 15.66s 318 4,992
MiMo-V2-Flash 10.0 10.0 100.0% 0 4.28s 75 3,504
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Mini 5.6 9.8 33.3% 0 14.09s 1,527 5,760
MiMo-V2-Flash 7.7 10.0 66.7% 0 3.77s 833 1,948
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Mini 10.0 10.0 100.0% 0 18.64s 487 1,600
MiMo-V2-Flash 10.0 10.0 100.0% 0 27.78s 321 12,715

Быстрое сравнение

Сменить пару сравнения