Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemma 4 31B vs OpenAI: GPT-5.4 Nano

Сводка

Сравнение benchmark Gemma 4 31B vs GPT-5.4 Nano: GPT-5.4 Nano лидирует по среднему баллу: 7.5 vs 6.1. Gemma 4 31B имеет более низкую стоимость benchmark: $0.004 vs $0.107. Gemma 4 31B быстрее: 4.05s vs 11.95s, с долей успешных попыток 47.6% vs 63.5%.

Рекомендуемая модель: Gemma 4 31B - Он дает лучший общий компромисс: конкурентный балл (6.1), ниже стоимость, чем у GPT-5.4 Nano, и сбалансированное время ответа.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Gemma 4 31B Gemma 4 31B none Релиз: 2026-04-02 Бесплатно доступно GPT-5.4 Nano GPT-5.4 Nano medium Релиз: 2026-03-17
Оценка 6.1 7.5
Ранг #98 #46
Надежность 10.0 10.0
Стабильность 10.0 8.4
Тестов верно
Доля успешных попыток 47.6% 63.5%
Нестабильные тесты 0 4
Всего запусков 63 63
Стоимость за результат 0.034 0.969
Общая стоимость $0.004 $0.107
Цена входа $0.120 / 1M $0.200 / 1M
Цена выхода $0.350 / 1M $1.250 / 1M
Общее число входных токенов 20,911 35,434
Выходные токены 1,407 3,014
Токены рассуждений 0 76,520
Время ответа (среднее) 4.05s 11.95s
Время ответа (макс.) 26.13s 94.06s
Время ответа (суммарно) 76.87s 250.98s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Gemma 4 31B

none
Стоимость
$0.001
Время
12.8s
Токены
795 tok

#46 GPT-5.4 Nano

medium
Стоимость
$0.007
Время
24.6s
Токены
4,943 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 852 45 0
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 8,352 285 0
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 903 27 0
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 576 117 0
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 795 78 0
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 6.5 10.0 33.3% 0 4.23s 828 108 0
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 224 12 0
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174

Быстрое сравнение

Сменить пару сравнения