OpenAI: GPT-5.3 Chat vs Xiaomi: MiMo-V2.5-Pro

GPT-5.3 Chat лидирует по среднему баллу: 7.5 vs 6.9. MiMo-V2.5-Pro (medium) имеет более низкую стоимость benchmark: $0.187 vs $0.571. GPT-5.3 Chat быстрее: 6.88s vs 33.92s, с долей успешных попыток 68.2% vs 66.7%.

Рекомендуемая модельGPT-5.3 ChatЗдесь у него лучший балл (7.5), и он отвечает примерно в 4.9 раза быстрее, чем MiMo-V2.5-Pro (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика	GPT-5.3 Chat GPT-5.3 Chat none Релиз: 2026-03-03	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Релиз: 2026-04-22

Метрика	GPT-5.3 Chat GPT-5.3 Chat none Релиз: 2026-03-03	MiMo-V2.5-Pro MiMo-V2.5-Pro medium Релиз: 2026-04-22
Оценка	7.5	6.9
Ранг	#62	#92
Надежность	10.0	10.0
Стабильность	8.2	8.2
Тестов верно
Доля успешных попыток	68.2%	66.7%
Нестабильные тесты	5	5
Всего запусков	66	66
Стоимость за результат	4.387	3.218
Общая стоимость	$0.571	$0.187
Цена входа	$1.750 / 1M	$0.435 / 1M
Цена выхода	$14.000 / 1M	$0.870 / 1M
Общее число входных токенов	78,990	139,883
Выходные токены	30,854	15,521
Токены рассуждений	0	130,992
Время ответа (среднее)	6.88s	33.92s
Время ответа (макс.)	18.33s	197.54s
Время ответа (суммарно)	151.31s	746.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.3 Chat

none

Стоимость: $0.008
Время: 8.1s
Токены: 634 tok

#92 MiMo-V2.5-Pro

medium

Неверный SVG

Стоимость: $0.000
Время: 300.0s
Токены: 0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Категория:

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	6.7	8.1	58.3%	1		3.86s	606	3,167	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		3.26s	621	323	1,179

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	5.6	4.7	55.6%	2		10.52s	7,302	6,632	0
MiMo-V2.5-Pro	6.2	4.7	66.7%	2		92.07s	6,543	780	51,218

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	10.0	10.0	100.0%	0		15.07s	55,800	6,851	0
MiMo-V2.5-Pro	6.9	5.9	66.7%	1		125.45s	114,089	10,854	45,120

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.21s	7,140	942	0
MiMo-V2.5-Pro	7.3	5.8	83.3%	1		18.81s	7,746	260	8,383

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	3.5	4.4	33.3%	2		13.01s	723	8,264	0
MiMo-V2.5-Pro	5.3	10.0	33.3%	0		37.87s	630	275	17,023

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	4.6	10.0	0.0%	0		1.99s	477	319	0
MiMo-V2.5-Pro	5.5	10.0	0.0%	0		4.02s	492	155	163

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	9.8	10.0	100.0%	0		3.51s	660	1,491	0
MiMo-V2.5-Pro	9.9	10.0	100.0%	0		2.77s	672	82	803

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.99s	642	1,758	0
MiMo-V2.5-Pro	6.7	7.9	55.6%	1		5.31s	660	540	2,181

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	10.0	10.0	100.0%	0		8.36s	5,445	861	0
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		16.87s	8,220	311	2,908

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.3 Chat	3.0	10.0	0.0%	0		4.38s	195	569	0
MiMo-V2.5-Pro	3.0	10.0	0.0%	0		12.46s	210	1,941	2,014

Быстрое сравнение

Сменить пару сравнения

GPT-5.6 SolnonevsMiMo-V2.5-Promedium DeepSeek V4 PrononevsMiMo-V2.5-Promedium Kimi K2.7 CodemediumvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsQwen3.5 Plus 2026-02-15medium Step 3.7 FlashhighvsMiMo-V2.5-Promedium GPT-5.5nonevsMiMo-V2.5-Promedium Nemotron 3 UltramediumБесплатно доступноvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsQwen3.5-27Bmedium Gemini 3.5 FlashminimalvsMiMo-V2.5-Promedium GPT-5.3 ChatnonevsGrok Build 0.1medium Gemini 3.5 FlashnonevsMiMo-V2.5-Promedium LongCat 2.0mediumvsGPT-5.3 Chatnone