Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.2

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-22

Метрика Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high Релиз: 2026-05-08 GPT-5.2 GPT-5.2 medium Релиз: 2025-12-11
Оценка 7.5 7.4
Ранг #48 #57
Надежность 9.8 10.0
Стабильность 8.1 8.3
Тестов верно
Доля успешных попыток 74.1% 70.0%
Нестабильные тесты 4 4
Всего запусков 54 60
Стоимость за результат 18.579 4.081
Общая стоимость $2.044 $0.490
???? ????? $0.250 / 1M $1.750 / 1M
???? ?????? $1.500 / 1M $14.000 / 1M
Выходные токены 1,984 2,754
Токены рассуждений 1,355,583 28,303
Время ответа (среднее) 61.96s 16.44s
Время ответа (макс.) 149.23s 77.80s
Время ответа (суммарно) 1115.31s 213.77s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 9.4 10.0 100.0% 0 37.16s 100 130,598
GPT-5.2 6.5 8.0 58.3% 1 7.81s 567 2,002
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 137.63s 666 188,733
GPT-5.2 10.0 10.0 100.0% 0 23.15s 490 8,269
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 149.23s 327 198,243
GPT-5.2 10.0 10.0 100.0% 0 14.06s 291 1,757
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.49s 279 7,351
GPT-5.2 10.0 10.0 100.0% 0 3.15s 234 420
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 3.6 7.2 22.2% 1 139.90s 18 566,210
GPT-5.2 5.9 7.2 55.6% 1 77.80s 42 10,342
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 5.0 2.1 66.7% 1 45.69s 95 64,644
GPT-5.2 3.7 9.7 0.0% 0 4.32s 162 269
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 7.3 5.8 83.3% 1 23.26s 52 3,549
GPT-5.2 9.9 10.0 100.0% 0 3.12s 94 614
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 5.7 6.8 44.4% 1 50.83s 213 193,654
GPT-5.2 7.6 7.3 77.8% 1 5.47s 609 938
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 6.44s 234 2,601
GPT-5.2 4.7 1.6 66.7% 1 10.30s 239 469
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite - - - - - - - -
GPT-5.2 3.0 10.0 0.0% 0 28.18s 26 3,223

Быстрое сравнение

Сменить пару сравнения