AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs Xiaomi: MiMo-V2-Pro

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-20

Метрика	GPT-5.2 Chat GPT-5.2 Chat none Релиз: 2025-12-11	MiMo-V2-Pro MiMo-V2-Pro medium Релиз: 2026-03-18

Метрика	GPT-5.2 Chat GPT-5.2 Chat none Релиз: 2025-12-11	MiMo-V2-Pro MiMo-V2-Pro medium Релиз: 2026-03-18
Оценка	7.8	8.0
Ранг	#25	#20
Стабильность	8.6	8.5
Тестов верно
Доля успешных попыток	74.5%	76.5%
Нестабильные тесты	3	3
Всего запусков	51	45
Стоимость за результат	2.462	1.110
Общая стоимость	$0.271	$0.123
???? ?????	$1.750 / 1M	$1.000 / 1M
???? ??????	$14.000 / 1M	$3.000 / 1M
Выходные токены	16,001	1,875
Токены рассуждений	0	26,959
Время ответа (среднее)	6.72s	9.78s
Время ответа (макс.)	38.52s	64.71s
Время ответа (суммарно)	114.20s	156.45s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	1,807	0
MiMo-V2-Pro	10.0	10.0	100.0%	0		3.06s	223	1,107

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	1,243	0
MiMo-V2-Pro	4.7	1.6	66.7%	1		64.71s	380	14,186

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	980	0
MiMo-V2-Pro	7.3	5.8	83.3%	1		17.20s	260	7,484

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	7,810	0
MiMo-V2-Pro	5.3	10.0	33.3%	0		6.00s	155	1,048

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	335	0
MiMo-V2-Pro	10.0	10.0	100.0%	0		4.06s	198	424

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.2 Chat	7.5	6.1	83.3%	1		5.46s	1,528	0
MiMo-V2-Pro	9.9	10.0	100.0%	0		3.36s	83	667

Puzzle Solving	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.42s	1,743	0
MiMo-V2-Pro	7.0	7.2	55.6%	1		4.71s	313	1,179

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	555	0
MiMo-V2-Pro	10.0	10.0	100.0%	0		8.19s	263	864

Быстрое сравнение

Сменить пару сравнения

Gemini 3 Flash PreviewnonevsMiMo-V2-Promedium Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2-Promedium GPT-5.2 ChatnonevsStep 3.5 FlashmediumБесплатно доступно GPT-5.2 ChatnonevsGrok 4.20 Betamedium Claude Sonnet 4.6mediumvsGPT-5.2 Chatnone Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2-Promedium GPT-5.2 ChatnonevsQwen3.5-Flashmedium GPT-5.2 ChatnonevsMiMo-V2-Flashmedium Gemini 3.1 Flash Lite PreviewlowvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsGLM 5 Turbomedium Claude Opus 4.6mediumvsGPT-5.2 Chatnone Gemini 3.1 Flash Lite PreviewmediumvsGPT-5.2 Chatnone