Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs OpenAI: GPT-5.4

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-03

Метрика Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none Релиз: 2026-03-03 GPT-5.4 GPT-5.4 medium Релиз: 2026-03-05
Оценка 7.5 7.9
Ранг #49 #27
Надежность 10.0 10.0
Стабильность 9.7 8.5
Тестов верно
Доля успешных попыток 63.3% 75.0%
Нестабильные тесты 1 4
Всего запусков 60 60
Стоимость за результат 0.142 8.765
Общая стоимость $0.017 $1.140
Цена входа $0.250 / 1M $2.500 / 1M
Цена выхода $1.500 / 1M $15.000 / 1M
Общее число входных токенов 34,579 31,489
Выходные токены 5,541 2,221
Токены рассуждений 0 68,486
Время ответа (среднее) 1.23s 22.31s
Время ответа (макс.) 3.39s 100.41s
Время ответа (суммарно) 24.68s 446.17s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 7.5 8.4 66.7% 1 1.04s 504 1,092 0
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 6.8 10.0 50.0% 0 1.06s 5,125 664 0
GPT-5.4 8.2 6.7 83.3% 1 54.98s 4,686 412 19,995
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 3.20s 13,026 339 0
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.22s 7,550 399 0
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 942ms 641 568 0
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 741ms 488 69 0
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.13s 623 574 0
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 900ms 570 1,045 0
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.39s 5,894 782 0
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 814ms 158 9 0
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

Быстрое сравнение

Сменить пару сравнения