Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 2.5 Flash vs OpenAI: GPT-5.4 Nano

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-17

Метрика Gemini 2.5 Flash Gemini 2.5 Flash none Релиз: 2025-06-17 GPT-5.4 Nano GPT-5.4 Nano medium Релиз: 2026-03-17
Ранг #48 #28
Оценка 5.9 7.4
Стабильность 9.1 9.0
Стоимость за результат 0.192 0.769
Общая стоимость $0.012 $0.077
Тестов верно
Доля успешных попыток 41.2% 66.7%
Нестабильные тесты 2 2
Всего запусков 51 51
Выходные токены 1,273 2,474
Токены рассуждений 0 54,516
Время ответа (среднее) 888ms 11.08s
Время ответа (макс.) 4.39s 94.06s
Время ответа (суммарно) 15.10s 188.39s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 3.0 10.0 0.0% 0 582ms 102 0
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 683 2,254
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 3.0 10.0 0.0% 0 4.39s 366 0
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 349 5,719
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 652ms 279 0
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 234 516
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 5.9 7.2 55.6% 1 495ms 12 0
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 60 43,325
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 5.0 10.0 0.0% 0 615ms 78 0
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 179 443
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 8.0 6.8 66.7% 1 672ms 70 0
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 95 521
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 5.7 10.0 33.3% 0 576ms 132 0
GPT-5.4 Nano 4.0 7.1 22.2% 1 3.65s 640 1,356
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 1.91s 234 0
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 234 382

Быстрое сравнение

Сменить пару сравнения