Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

xAI: Grok Build 0.1 vs Xiaomi: MiMo-V2-Flash

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-22

Метрика Grok Build 0.1 Grok Build 0.1 none Релиз: 2026-05-21 MiMo-V2-Flash MiMo-V2-Flash medium Релиз: 2025-12-16
Оценка 6.6 7.1
Ранг #82 #67
Надежность 10.0 10.0
Стабильность 8.0 8.7
Тестов верно
Доля успешных попыток 60.4% 63.3%
Нестабильные тесты 4 3
Всего запусков 57 60
Стоимость за результат 7.805 0.345
Общая стоимость $0.547 $0.038
???? ????? $1.000 / 1M $0.100 / 1M
???? ?????? $2.000 / 1M $0.300 / 1M
Выходные токены 267,275 12,427
Токены рассуждений 0 115,182
Время ответа (среднее) 28.69s 20.26s
Время ответа (макс.) 138.35s 96.01s
Время ответа (суммарно) 459.00s 283.68s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 8.7 7.9 91.7% 1 6.30s 11,162 0
MiMo-V2-Flash 8.1 7.9 83.3% 1 15.85s 1,674 23,559
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 10.0 10.0 100.0% 0 21.41s 16,568 0
MiMo-V2-Flash 4.1 5.8 33.3% 1 7.20s 456 3,648
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 0.0 0.0 0.0% 0 0ms 0 0
MiMo-V2-Flash 9.8 10.0 100.0% 0 75.68s 442 26,859
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 4.7 1.6 66.7% 1 9.33s 6,359 0
MiMo-V2-Flash 6.5 10.0 50.0% 0 0ms 153 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 3.6 7.2 22.2% 1 103.71s 179,469 0
MiMo-V2-Flash 5.9 7.2 55.6% 1 96.01s 8,374 42,461
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 4.3 10.0 0.0% 0 12.47s 6,647 0
MiMo-V2-Flash 4.0 10.0 0.0% 0 4.20s 87 488
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 9.8 10.0 100.0% 0 7.36s 8,970 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 4.28s 75 3,504
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 6.4 7.7 55.6% 1 9.55s 14,982 0
MiMo-V2-Flash 7.7 10.0 66.7% 0 3.77s 833 1,948
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 0.0 0.0 0.0% 0 0ms 0 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 27.78s 321 12,715
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Grok Build 0.1 3.0 10.0 0.0% 0 36.09s 23,118 0
MiMo-V2-Flash 3.0 10.0 0.0% 0 1.96s 12 0

Быстрое сравнение

Сменить пару сравнения