Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 2.5 Flash vs Xiaomi: MiMo-V2-Flash

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-15

Метрика Gemini 2.5 Flash Gemini 2.5 Flash medium Релиз: 2025-06-17 MiMo-V2-Flash MiMo-V2-Flash medium Релиз: 2025-12-16
Ранг #15 #18
Оценка 8.0 7.9
Стабильность 9.5 9.5
Стоимость за результат 2.619 0.316
Общая стоимость $0.288 $0.035
Тестов верно
Доля успешных попыток 72.9% 72.9%
Нестабильные тесты 1 1
Всего запусков 48 48
Выходные токены 1,370 11,613
Токены рассуждений 110,522 106,714
Время ответа (среднее) 12.35s 25.33s
Время ответа (макс.) 95.48s 96.01s
Время ответа (суммарно) 197.62s 253.33s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 7.8 10.0 66.7% 0 6.98s 249 8,832
MiMo-V2-Flash 9.9 10.0 100.0% 0 16.79s 1,328 18,739
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
MiMo-V2-Flash 9.8 10.0 100.0% 0 75.68s 442 26,859
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
MiMo-V2-Flash 6.5 10.0 50.0% 0 0ms 153 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
MiMo-V2-Flash 5.9 7.2 55.6% 1 96.01s 8,374 42,461
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
MiMo-V2-Flash 4.0 10.0 0.0% 0 4.20s 87 488
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
MiMo-V2-Flash 10.0 10.0 100.0% 0 4.28s 75 3,504
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
MiMo-V2-Flash 7.7 10.0 66.7% 0 3.77s 833 1,948
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
MiMo-V2-Flash 10.0 10.0 100.0% 0 27.78s 321 12,715

Быстрое сравнение

Сменить пару сравнения