AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-4o-mini

Сводка

Сравнение benchmark Kimi K2.5 vs GPT-4o-mini: Kimi K2.5 лидирует по среднему баллу: 5.5 vs 5.0. GPT-4o-mini имеет более низкую стоимость benchmark: $0.006 vs $0.027. GPT-4o-mini быстрее: 1.77s vs 13.18s, с долей успешных попыток 34.9% vs 23.8%.

Рекомендуемая модель: Kimi K2.5 - У него самый высокий балл в этом сравнении (5.5) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-02

Метрика	Kimi K2.5 Kimi K2.5 none Релиз: 2026-01-27	GPT-4o-mini GPT-4o-mini none Релиз: 2024-07-18

Метрика	Kimi K2.5 Kimi K2.5 none Релиз: 2026-01-27	GPT-4o-mini GPT-4o-mini none Релиз: 2024-07-18
Оценка	5.5	5.0
Ранг	#122	#144
Надежность	10.0	10.0
Стабильность	8.9	9.9
Тестов верно
Доля успешных попыток	34.9%	23.8%
Нестабильные тесты	3	0
Всего запусков	63	63
Стоимость за результат	0.442	0.119
Общая стоимость	$0.027	$0.006
Цена входа	$0.375 / 1M	$0.150 / 1M
Цена выхода	$2.025 / 1M	$0.600 / 1M
Общее число входных токенов	36,034	31,518
Выходные токены	6,657	1,982
Токены рассуждений	0	0
Время ответа (среднее)	13.18s	1.77s
Время ответа (макс.)	42.13s	7.58s
Время ответа (суммарно)	184.47s	24.80s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 MoonshotAI: Kimi K2.5

none

Стоимость: $0.015
Время: 89.1s
Токены: 5,421 tok

#144 GPT-4o-mini

none

Стоимость: $0.001
Время: 6.6s
Токены: 742 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	3.6	8.4	8.3%	1		6.24s	652	373	0
GPT-4o-mini	4.8	10.0	25.0%	0		1.34s	618	186	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	5.5	10.0	33.3%	0		24.56s	7,311	4,708	0
GPT-4o-mini	3.2	9.6	0.0%	0		1.63s	7,314	367	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	2.8	2.1	33.3%	1		19.16s	12,264	748	0
GPT-4o-mini	3.0	10.0	0.0%	0		7.58s	8,298	568	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	7.3	5.8	83.3%	1		42.13s	7,180	187	0
GPT-4o-mini	10.0	10.0	100.0%	0		1.27s	7,161	183	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	5.3	10.0	33.3%	0		4.38s	753	29	0
GPT-4o-mini	3.0	10.0	0.0%	0		637ms	732	15	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	10.0	10.0	100.0%	0		4.00s	483	76	0
GPT-4o-mini	4.0	10.0	0.0%	0		909ms	480	66	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	6.5	10.0	50.0%	0		2.67s	677	60	0
GPT-4o-mini	6.3	10.0	50.0%	0		1.11s	666	69	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	3.0	10.0	0.0%	0		4.04s	667	236	0
GPT-4o-mini	3.5	10.0	0.0%	0		1.21s	651	308	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	10.0	10.0	100.0%	0		13.99s	5,835	220	0
GPT-4o-mini	10.0	10.0	100.0%	0		2.51s	5,400	205	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	3.0	10.0	0.0%	0		3.90s	212	20	0
GPT-4o-mini	3.0	10.0	0.0%	0		794ms	198	15	0

Быстрое сравнение

Сменить пару сравнения

CobuddymediumvsGPT-4o-mininone Mistral Small 4mediumvsGPT-4o-mininone MiniMax M2.5mediumvsGPT-4o-mininone MiniMax M2.7mediumvsGPT-4o-mininone GPT-4o-mininonevsQwen3 Coder Nextmedium MiniMax M2.7mediumvsKimi K2.5none North Mini CodemediumБесплатно доступноvsKimi K2.5none Mistral Small 4mediumvsKimi K2.5none CobuddymediumvsKimi K2.5none Gemini 3.1 Flash LiteminimalvsKimi K2.5none GPT-4o-mininonevsGLM 4.7 Flashmedium MiniMax M2.5mediumvsKimi K2.5none