Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemma 4 31B vs OpenAI: GPT-5 Nano

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-02

Метрика Gemma 4 31B Gemma 4 31B none Релиз: 2026-04-02 GPT-5 Nano GPT-5 Nano medium Релиз: 2025-08-07
Оценка 6.7 6.2
Ранг #47 #52
Стабильность 10.0 6.7
Тестов верно
Доля успешных попыток 52.9% 58.8%
Нестабильные тесты 0 7
Всего запусков 51 51
Стоимость за результат 0.023 0.864
Общая стоимость $0.002 $0.061
???? ????? $0.140 / 1M $0.050 / 1M
???? ?????? $0.400 / 1M $0.400 / 1M
Выходные токены 660 4,500
Токены рассуждений 0 143,296
Время ответа (среднее) 2.55s 44.47s
Время ответа (макс.) 4.68s 204.02s
Время ответа (суммарно) 38.20s 444.74s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 45 0
GPT-5 Nano 6.5 7.9 58.3% 1 25.50s 1,221 21,184
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
GPT-5 Nano 10.0 10.0 100.0% 0 65.96s 578 17,984
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 285 0
GPT-5 Nano 3.7 1.7 50.0% 2 21.42s 453 10,560
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 27 0
GPT-5 Nano 5.2 4.4 55.6% 2 204.02s 237 64,448
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 117 0
GPT-5 Nano 4.1 10.0 0.0% 0 17.51s 202 4,608
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 78 0
GPT-5 Nano 8.5 6.8 83.3% 1 11.90s 382 4,096
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 5.5 10.0 33.3% 0 2.95s 108 0
GPT-5 Nano 5.3 7.2 44.4% 1 19.81s 869 13,440
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
GPT-5 Nano 10.0 10.0 100.0% 0 33.30s 558 6,976

Быстрое сравнение

Сменить пару сравнения