AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.2 Chat

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-08

Метрика	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Релиз: 2026-05-08	GPT-5.2 Chat GPT-5.2 Chat none Релиз: 2025-12-11

Метрика	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Релиз: 2026-05-08	GPT-5.2 Chat GPT-5.2 Chat none Релиз: 2025-12-11
Оценка	7.6	7.6
Ранг	#44	#41
Надежность	10.0	10.0
Стабильность	9.2	8.8
Тестов верно
Доля успешных попыток	68.4%	71.9%
Нестабильные тесты	2	3
Всего запусков	57	57
Стоимость за результат	0.203	2.572
Общая стоимость	$0.025	$0.309
???? ?????	$0.250 / 1M	$1.750 / 1M
???? ??????	$1.500 / 1M	$14.000 / 1M
Выходные токены	2,702	18,585
Токены рассуждений	8,596	0
Время ответа (среднее)	1.92s	6.85s
Время ответа (макс.)	5.66s	38.52s
Время ответа (суммарно)	36.49s	130.06s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	7.3	6.2	75.0%	2		1.84s	1,013	1,548
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	1,807	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.46s	441	408
GPT-5.2 Chat	10.0	10.0	100.0%	0		8.97s	1,345	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		4.48s	348	975
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	1,243	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.44s	291	697
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	980	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	5.3	10.0	33.3%	0		1.52s	15	1,214
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	7,810	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	4.0	10.0	0.0%	0		1.37s	69	438
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	335	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.52s	72	760
GPT-5.2 Chat	7.3	5.9	83.3%	1		5.46s	1,528	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.40s	210	1,191
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.42s	1,743	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		5.66s	234	945
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	555	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		1.46s	9	420
GPT-5.2 Chat	3.0	10.0	0.0%	0		6.89s	1,239	0

Быстрое сравнение

Сменить пару сравнения

Gemini 3.1 Flash LitelowvsStep 3.5 Flashmedium Gemini 3.1 Flash LitelowvsQwen3.5-Flashmedium Gemini 3.1 Flash LitelowvsKimi K2.6medium Kimi K2.6mediumvsGPT-5.2 Chatnone Gemini 3.1 Flash LitelowvsGPT-5.3 Chatnone GPT-5.2 ChatnonevsStep 3.5 Flashmedium Gemini 3.1 Flash LitelowvsGLM 5.1medium GPT-5.2 ChatnonevsQwen3.5-Flashmedium DeepSeek V4 FlashhighvsGemini 3.1 Flash Litelow Gemma 4 26B A4BmediumБесплатно доступноvsGPT-5.2 Chatnone Gemini 3.1 Flash LitelowvsGLM 5V Turbomedium GPT-5.2 ChatnonevsGLM 5.1medium