AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Google: Gemini 3.1 Flash Lite

Сводка

Сравнение benchmark DeepSeek V4 Pro vs Gemini 3.1 Flash Lite: Gemini 3.1 Flash Lite лидирует по среднему баллу: 7.8 vs 7.2. DeepSeek V4 Pro имеет более низкую стоимость benchmark: $0.034 vs $0.071. Gemini 3.1 Flash Lite быстрее: 3.23s vs 6.41s, с долей успешных попыток 52.4% vs 65.1%.

Рекомендуемая модель: Gemini 3.1 Flash Lite - Здесь у него лучший балл (7.8), и он отвечает примерно в 2.0 раза быстрее, чем DeepSeek V4 Pro.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика	DeepSeek V4 Pro DeepSeek V4 Pro none Релиз: 2026-04-24	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium Релиз: 2026-05-08

Метрика	DeepSeek V4 Pro DeepSeek V4 Pro none Релиз: 2026-04-24	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium Релиз: 2026-05-08
Оценка	7.2	7.8
Ранг	#58	#34
Надежность	9.9	10.0
Стабильность	8.8	9.2
Тестов верно
Доля успешных попыток	52.4%	65.1%
Нестабильные тесты	3	2
Всего запусков	63	63
Стоимость за результат	0.333	0.539
Общая стоимость	$0.034	$0.071
Цена входа	$0.435 / 1M	$0.250 / 1M
Цена выхода	$0.870 / 1M	$1.500 / 1M
Общее число входных токенов	53,558	36,808
Выходные токены	11,424	2,254
Токены рассуждений	0	38,300
Время ответа (среднее)	6.41s	3.23s
Время ответа (макс.)	30.09s	10.87s
Время ответа (суммарно)	134.66s	67.80s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#58 DeepSeek V4 Pro

none

Неверный SVG

Стоимость: $0.000
Время: 300.0s
Токены: 0 tok

#34 Gemini 3.1 Flash Lite

medium

Стоимость: $0.003
Время: 5.3s
Токены: 1,754 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	3.2	6.1	16.7%	2		4.02s	540	1,168	0
Gemini 3.1 Flash Lite	9.1	10.0	75.0%	0		2.39s	502	604	4,201

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	5.6	10.0	33.3%	0		13.38s	7,275	5,500	0
Gemini 3.1 Flash Lite	5.5	10.0	33.3%	0		3.81s	8,134	459	8,978

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	9.5	10.0	100.0%	0		23.74s	27,529	2,235	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		10.87s	12,873	327	7,401

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	10.0	10.0	100.0%	0		4.61s	7,568	200	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		2.60s	7,362	279	2,845

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	5.3	10.0	33.3%	0		3.72s	666	24	0
Gemini 3.1 Flash Lite	2.9	7.2	11.1%	1		3.16s	643	15	5,165

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	5.0	10.0	0.0%	0		2.05s	471	126	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		2.60s	488	84	1,142

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	6.3	5.8	66.7%	1		4.12s	627	713	0
Gemini 3.1 Flash Lite	9.9	10.0	100.0%	0		2.59s	623	75	3,320

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	10.0	10.0	100.0%	0		3.61s	594	442	0
Gemini 3.1 Flash Lite	7.6	7.2	77.8%	1		1.95s	568	165	2,450

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	10.0	10.0	100.0%	0		7.40s	8,105	328	0
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		4.55s	5,457	234	921

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	3.0	10.0	0.0%	0		5.76s	183	688	0
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		3.08s	158	12	1,877

Быстрое сравнение

Сменить пару сравнения