Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: GPT-5 Nano

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика Gemini 3.5 Flash Gemini 3.5 Flash low Релиз: 2026-05-19 GPT-5 Nano GPT-5 Nano medium Релиз: 2025-08-07
Оценка 9.6 6.2
Ранг #2 #90
Надежность 10.0 10.0
Стабильность 10.0 7.0
Тестов верно
Доля успешных попыток 94.7% 57.9%
Нестабильные тесты 0 7
Всего запусков 57 57
Стоимость за результат 1.359 0.856
Общая стоимость $0.245 $0.069
???? ????? $1.500 / 1M $0.050 / 1M
???? ?????? $9.000 / 1M $0.400 / 1M
Выходные токены 2,003 5,214
Токены рассуждений 20,245 162,432
Время ответа (среднее) 2.84s 42.13s
Время ответа (макс.) 6.44s 204.02s
Время ответа (суммарно) 54.00s 505.59s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 209 2,536
GPT-5 Nano 6.5 7.9 58.3% 1 25.50s 1,221 21,184
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 5.49s 428 3,146
GPT-5 Nano 6.7 3.5 66.7% 1 40.73s 480 12,992
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 351 3,050
GPT-5 Nano 10.0 10.0 100.0% 0 65.96s 578 17,984
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 279 1,164
GPT-5 Nano 3.7 1.7 50.0% 2 21.42s 453 10,560
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 12 4,538
GPT-5 Nano 5.2 4.4 55.6% 2 204.02s 237 64,448
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 119 916
GPT-5 Nano 4.1 10.0 0.0% 0 17.51s 202 4,608
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 71 1,652
GPT-5 Nano 9.8 10.0 100.0% 0 11.90s 382 4,096
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 288 2,150
GPT-5 Nano 5.3 7.2 44.4% 1 19.81s 869 13,440
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 234 403
GPT-5 Nano 10.0 10.0 100.0% 0 33.30s 558 6,976
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 12 690
GPT-5 Nano 3.0 10.0 0.0% 0 20.13s 234 6,144

Быстрое сравнение

Сменить пару сравнения