MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.3 Chat

GPT-5.3 Chat лидирует по среднему баллу: 7.5 vs 7.0. GPT-5.3 Chat имеет более низкую стоимость benchmark: $0.571 vs $0.600. GPT-5.3 Chat быстрее: 6.88s vs 99.00s, с долей успешных попыток 65.2% vs 68.2%.

Рекомендуемая модельGPT-5.3 ChatЗдесь у него лучший балл (7.5), и он отвечает примерно в 14.4 раза быстрее, чем Kimi K2.5 (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика	Kimi K2.5 Kimi K2.5 medium Релиз: 2026-01-27	GPT-5.3 Chat GPT-5.3 Chat none Релиз: 2026-03-03

Метрика	Kimi K2.5 Kimi K2.5 medium Релиз: 2026-01-27	GPT-5.3 Chat GPT-5.3 Chat none Релиз: 2026-03-03
Оценка	7.0	7.5
Ранг	#85	#62
Надежность	10.0	10.0
Стабильность	7.0	8.2
Тестов верно
Доля успешных попыток	65.2%	68.2%
Нестабильные тесты	8	5
Всего запусков	66	66
Стоимость за результат	4.789	4.387
Общая стоимость	$0.600	$0.571
Цена входа	$0.571 / 1M	$1.750 / 1M
Цена выхода	$2.850 / 1M	$14.000 / 1M
Общее число входных токенов	118,448	78,990
Выходные токены	62,124	30,854
Токены рассуждений	165,243	0
Время ответа (среднее)	99.00s	6.88s
Время ответа (макс.)	281.00s	18.33s
Время ответа (суммарно)	1485.04s	151.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 MoonshotAI: Kimi K2.5

medium

Стоимость: $0.030
Время: 58.6s
Токены: 8,683 tok

#62 GPT-5.3 Chat

none

Стоимость: $0.008
Время: 8.1s
Токены: 634 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Категория:

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	7.3	5.8	83.3%	2		51.38s	634	2,789	8,880
GPT-5.3 Chat	6.7	8.1	58.3%	1		3.86s	606	3,167	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	6.1	4.6	66.7%	2		217.49s	6,935	5,705	74,693
GPT-5.3 Chat	5.6	4.7	55.6%	2		10.52s	7,302	6,632	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	6.7	9.1	50.0%	0		89.19s	95,416	14,448	11,209
GPT-5.3 Chat	10.0	10.0	100.0%	0		15.07s	55,800	6,851	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	10.0	10.0	100.0%	0		49.78s	7,020	563	7,940
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.21s	7,140	942	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	3.5	4.4	33.3%	2		137.29s	485	20,753	30,564
GPT-5.3 Chat	3.5	4.4	33.3%	2		13.01s	723	8,264	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	6.5	3.4	66.7%	1		69.73s	480	3,815	4,262
GPT-5.3 Chat	4.6	10.0	0.0%	0		1.99s	477	319	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	10.0	10.0	100.0%	0		92.47s	675	5,371	6,547
GPT-5.3 Chat	9.8	10.0	100.0%	0		3.51s	660	1,491	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	5.3	7.3	44.4%	1		43.23s	659	8,426	12,692
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.99s	642	1,758	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	10.0	10.0	100.0%	0		31.74s	5,933	242	812
GPT-5.3 Chat	10.0	10.0	100.0%	0		8.36s	5,445	861	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Kimi K2.5	3.0	10.0	0.0%	0		83.95s	211	12	7,644
GPT-5.3 Chat	3.0	10.0	0.0%	0		4.38s	195	569	0

Быстрое сравнение

Сменить пару сравнения

Gemini 3.5 FlashnonevsKimi K2.5medium Kimi K2.7 CodemediumvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsQwen3.5 Plus 2026-02-15medium Nemotron 3 UltramediumБесплатно доступноvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsQwen3.5-27Bmedium GPT-5.3 ChatnonevsGrok Build 0.1medium DeepSeek V4 PrononevsKimi K2.5medium Kimi K2.5mediumvsGPT-5.6 Solnone LongCat 2.0mediumvsGPT-5.3 Chatnone MiniMax M3mediumvsGPT-5.3 Chatnone Gemini 3 Flash PreviewlowvsGPT-5.3 Chatnone Kimi K2.5mediumvsStep 3.7 Flashhigh