AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Google: Gemini 3.1 Flash Lite

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-22

Метрика	DeepSeek V4 Pro DeepSeek V4 Pro none Релиз: 2026-04-24	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Релиз: 2026-05-08

Метрика	DeepSeek V4 Pro DeepSeek V4 Pro none Релиз: 2026-04-24	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Релиз: 2026-05-08
Оценка	6.0	6.7
Ранг	#95	#78
Надежность	8.1	10.0
Стабильность	8.9	8.8
Тестов верно
Доля успешных попыток	48.3%	56.7%
Нестабильные тесты	3	3
Всего запусков	60	60
Стоимость за результат	0.564	0.123
Общая стоимость	$0.046	$0.013
???? ?????	$0.435 / 1M	$0.250 / 1M
???? ??????	$0.870 / 1M	$1.500 / 1M
Выходные токены	5,347	2,481
Токены рассуждений	0	0
Время ответа (среднее)	13.48s	1.37s
Время ответа (макс.)	58.65s	4.49s
Время ответа (суммарно)	269.56s	27.32s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	3.5	8.0	16.7%	1		14.02s	704	0
Gemini 3.1 Flash Lite	8.3	10.0	75.0%	0		1.10s	639	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	5.4	6.8	33.3%	1		8.27s	527	0
Gemini 3.1 Flash Lite	6.8	10.0	50.0%	0		951ms	660	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	9.5	10.0	100.0%	0		25.49s	1,911	0
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		2.53s	357	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	8.8	10.0	100.0%	0		30.54s	170	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.04s	279	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	5.3	10.0	33.3%	0		3.17s	18	0
Gemini 3.1 Flash Lite	2.9	7.2	11.1%	1		1.02s	15	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	4.3	9.9	0.0%	0		3.75s	132	0
Gemini 3.1 Flash Lite	4.0	10.0	0.0%	0		791ms	63	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	6.3	10.0	50.0%	0		8.23s	64	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		932ms	72	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	7.6	7.2	77.8%	1		19.72s	175	0
Gemini 3.1 Flash Lite	6.0	4.6	66.7%	2		2.15s	153	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	10.0	10.0	100.0%	0		5.92s	219	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		3.51s	234	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	3.0	10.0	0.0%	0		15.59s	1,427	0
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		724ms	9	0

Быстрое сравнение

Сменить пару сравнения

Gemini 3.1 Flash LiteminimalvsKimi K2.5medium DeepSeek V4 ProhighvsGemini 3.1 Flash Liteminimal Gemini 3.1 Flash LiteminimalvsGrok 4.20medium Gemini 3.1 Flash LiteminimalvsGrok Build 0.1none DeepSeek V4 PrononevsGPT-5 Nanomedium Gemini 3.1 Flash LiteminimalvsQwen3.6 27Bmedium DeepSeek V4 PrononevsNemotron 3 SupermediumБесплатно доступно Gemini 3.1 Flash LiteminimalvsGPT-5.5none DeepSeek V4 PrononevsOwl Alphamedium DeepSeek V4 PrononevsMercury 2medium Gemini 3.1 Flash LiteminimalvsGPT-5 Minimedium Gemini 3.1 Flash LiteminimalvsMiMo-V2-Omnimedium