AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs OpenAI: GPT-5.2 Chat

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-01

Метрика	Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Релиз: 2026-03-03	GPT-5.2 Chat GPT-5.2 Chat none Релиз: 2025-12-11

Метрика	Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Релиз: 2026-03-03	GPT-5.2 Chat GPT-5.2 Chat none Релиз: 2025-12-11
Оценка	7.7	7.9
Ранг	#38	#32
Надежность	10.0	10.0
Стабильность	10.0	8.9
Тестов верно
Доля успешных попыток	65.0%	73.3%
Нестабильные тесты	0	3
Всего запусков	60	60
Стоимость за результат	0.481	2.703
Общая стоимость	$0.063	$0.352
Цена входа	$0.250 / 1M	$1.750 / 1M
Цена выхода	$1.500 / 1M	$14.000 / 1M
Выходные токены	2,204	21,144
Токены рассуждений	33,657	0
Время ответа (среднее)	3.94s	6.82s
Время ответа (макс.)	14.93s	38.52s
Время ответа (суммарно)	78.74s	136.34s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	9.1	10.0	75.0%	0		2.33s	570	4,305
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	1,807	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	6.8	10.0	50.0%	0		3.98s	455	5,510
GPT-5.2 Chat	8.2	6.7	83.3%	1		8.05s	4,131	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		14.93s	327	7,347
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	1,243	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		2.29s	279	2,952
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	980	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	3.0	10.0	0.0%	0		4.21s	18	5,325
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	7,810	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		3.16s	96	1,488
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	335	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		1.91s	72	2,121
GPT-5.2 Chat	9.8	10.0	100.0%	0		5.51s	1,441	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	7.7	10.0	66.7%	0		5.30s	141	1,896
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.10s	1,603	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		3.80s	234	912
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	555	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite Preview	3.0	10.0	0.0%	0		2.68s	12	1,801
GPT-5.2 Chat	3.0	10.0	0.0%	0		6.89s	1,239	0

Быстрое сравнение

Сменить пару сравнения

Gemma 4 26B A4BmediumБесплатно доступноvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsStep 3.7 Flashmedium GPT-5.2 ChatnonevsGLM 5 Turbomedium GPT-5.2 ChatnonevsQwen3.5-27Bmedium GPT-5.2 ChatnonevsQwen3.6 35B A3Bmedium GPT-5.2 ChatnonevsGrok 4.3medium Gemini 3.5 FlashminimalvsGPT-5.2 Chatnone DeepSeek V4 FlashhighvsGemini 3.1 Flash Lite Previewmedium GPT-5.2 ChatnonevsQwen3.6 Plusmedium Gemma 4 31BmediumБесплатно доступноvsGPT-5.2 Chatnone Gemini 3.1 Flash LitemediumvsGPT-5.2 Chatnone Gemini 2.5 FlashmediumvsGPT-5.2 Chatnone