Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Xiaomi: MiMo-V2-Flash

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-08

Метрика Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Релиз: 2026-05-08 MiMo-V2-Flash MiMo-V2-Flash medium Релиз: 2025-12-16
Оценка 6.8 7.2
Ранг #68 #55
Надежность 10.0 10.0
Стабильность 8.7 8.7
Тестов верно
Доля успешных попыток 59.7% 66.7%
Нестабильные тесты 3 3
Всего запусков 57 57
Стоимость за результат 0.111 0.341
Общая стоимость $0.012 $0.038
???? ????? $0.250 / 1M $0.100 / 1M
???? ?????? $1.500 / 1M $0.300 / 1M
Выходные токены 2,457 12,399
Токены рассуждений 0 115,182
Время ответа (среднее) 1.41s 21.71s
Время ответа (макс.) 4.49s 96.01s
Время ответа (суммарно) 26.72s 282.29s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 8.3 10.0 75.0% 0 1.10s 639 0
MiMo-V2-Flash 8.1 7.9 83.3% 1 15.85s 1,674 23,559
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.31s 636 0
MiMo-V2-Flash 4.7 1.6 66.7% 1 13.03s 428 3,648
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 2.53s 357 0
MiMo-V2-Flash 9.8 10.0 100.0% 0 75.68s 442 26,859
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.04s 279 0
MiMo-V2-Flash 6.5 10.0 50.0% 0 0ms 153 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 1.02s 15 0
MiMo-V2-Flash 5.9 7.2 55.6% 1 96.01s 8,374 42,461
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 791ms 63 0
MiMo-V2-Flash 4.0 10.0 0.0% 0 4.20s 87 488
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 932ms 72 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 4.28s 75 3,504
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 6.0 4.6 66.7% 2 2.15s 153 0
MiMo-V2-Flash 7.7 10.0 66.7% 0 3.77s 833 1,948
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 3.51s 234 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 27.78s 321 12,715
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 724ms 9 0
MiMo-V2-Flash 3.0 10.0 0.0% 0 1.96s 12 0

Быстрое сравнение

Сменить пару сравнения