AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs OpenAI: GPT-5 Nano

Сводка

Сравнение benchmark DeepSeek V4 Pro vs GPT-5 Nano: GPT-5 Nano лидирует по среднему баллу: 6.3 vs 5.7. DeepSeek V4 Pro имеет более низкую стоимость benchmark: $0.025 vs $0.081. DeepSeek V4 Pro быстрее: 12.38s vs 42.51s, с долей успешных попыток 42.9% vs 57.1%.

Рекомендуемая модель: DeepSeek V4 Pro - Его балл близок к лучшему здесь (5.7 против 6.3), при этом он примерно в 3.3 раза дешевле, чем GPT-5 Nano.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-04

Метрика	DeepSeek V4 Pro DeepSeek V4 Pro none Релиз: 2026-04-24	GPT-5 Nano GPT-5 Nano medium Релиз: 2025-08-07

Метрика	DeepSeek V4 Pro DeepSeek V4 Pro none Релиз: 2026-04-24	GPT-5 Nano GPT-5 Nano medium Релиз: 2025-08-07
Оценка	5.7	6.3
Ранг	#113	#94
Надежность	8.5	10.0
Стабильность	8.5	7.3
Тестов верно
Доля успешных попыток	42.9%	57.1%
Нестабильные тесты	4	7
Всего запусков	63	63
Стоимость за результат	0.660	0.897
Общая стоимость	$0.025	$0.081
Цена входа	$0.435 / 1M	$0.050 / 1M
Цена выхода	$0.870 / 1M	$0.400 / 1M
Общее число входных токенов	44,845	34,108
Выходные токены	5,349	5,464
Токены рассуждений	0	192,064
Время ответа (среднее)	12.38s	42.51s
Время ответа (макс.)	58.65s	204.02s
Время ответа (суммарно)	260.06s	595.09s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#113 DeepSeek V4 Pro

none

Invalid SVG

Cost: $0.000
Time: 300.0s
Tokens: 0 tok

#94 GPT-5 Nano

medium

Cost: $0.006
Time: 108.5s
Tokens: 13,209 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	3.5	8.0	16.7%	1		14.02s	540	704	0
GPT-5 Nano	6.5	7.9	58.3%	1		25.50s	606	1,221	21,184

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	4.6	7.9	22.2%	1		6.11s	7,279	531	0
GPT-5 Nano	7.0	7.7	55.6%	1		41.62s	7,305	740	41,152

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	9.5	10.0	100.0%	0		25.49s	20,773	1,911	0
GPT-5 Nano	10.0	10.0	100.0%	0		65.96s	11,019	578	17,984

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	6.9	5.8	66.7%	1		30.54s	5,633	170	0
GPT-5 Nano	3.7	1.7	50.0%	2		21.42s	7,140	453	10,560

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	5.3	10.0	33.3%	0		3.17s	666	18	0
GPT-5 Nano	5.2	4.4	55.6%	2		204.02s	619	237	64,448

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	4.3	9.9	0.0%	0		3.75s	471	132	0
GPT-5 Nano	4.1	10.0	0.0%	0		17.51s	477	202	4,608

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	6.3	10.0	50.0%	0		8.23s	627	64	0
GPT-5 Nano	9.8	10.0	100.0%	0		15.64s	660	312	4,736

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	7.6	7.2	77.8%	1		15.95s	594	173	0
GPT-5 Nano	5.3	7.2	44.4%	1		20.63s	642	929	14,272

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	10.0	10.0	100.0%	0		5.92s	8,079	219	0
GPT-5 Nano	10.0	10.0	100.0%	0		33.30s	5,445	558	6,976

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	3.0	10.0	0.0%	0		15.59s	183	1,427	0
GPT-5 Nano	3.0	10.0	0.0%	0		20.13s	195	234	6,144

Быстрое сравнение

Сменить пару сравнения

GPT-5 NanomediumvsQwen3.5 Plus 2026-02-15none CobuddymediumvsDeepSeek V4 Pronone DeepSeek V4 PrononevsNemotron 3 SupermediumБесплатно доступно Ring-2.6-1TnonevsGPT-5 Nanomedium Gemini 2.5 FlashnonevsGPT-5 Nanomedium Gemini 3.1 Flash LitenonevsGPT-5 Nanomedium GPT-5 NanomediumvsQwen3.7 Plusnone Gemini 3.1 Flash LiteminimalvsGPT-5 Nanomedium GPT-5 NanomediumvsGLM 5none Gemma 4 31BnoneБесплатно доступноvsGPT-5 Nanomedium Gemma 4 26B A4BnoneБесплатно доступноvsGPT-5 Nanomedium DeepSeek V4 ProhighvsGPT-5 Nanomedium