Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemma 4 31B (medium) vs GPT-5.6 Luna (low)

Средний балл практически равен: 6.2 vs 6.2. GPT-5.6 Luna (low) имеет более низкую стоимость benchmark: $0.051 vs $0.100. GPT-5.6 Luna (low) быстрее: 5.20s vs 78.59s, с долей успешных попыток 65.2% vs 54.5%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-20

Ранг
#166
Общее число выходных токенов
267,421
Время ответа (среднее)
78.59s
Общая стоимость
$0.100
Ранг
#167
Общее число выходных токенов
26,286
Время ответа (среднее)
5.20s
Общая стоимость
$0.051
Рекомендуемая модель GPT-5.6 Luna (low)

Здесь у него лучший балл (6.2), при этом он примерно в 2.0 раза дешевле, чем Gemma 4 31B (medium).

Подробное сравнение

Метрика Gemma 4 31B Gemma 4 31B medium Релиз: 2026-04-02 Бесплатно доступно GPT-5.6 Luna GPT-5.6 Luna low Релиз: 2026-07-09
Оценка 6.2 6.2
Ранг #166 #167
Надежность 10.0 10.0
Стабильность 8.7 8.2
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 65.2% 54.5%
Нестабильные тесты 3 5
Всего запусков 66 66
Стоимость за результат 1.152 2.437
Общая стоимость $0.100 $0.051
Цена входа $0.090 / 1M $0.200 / 1M
Цена выхода $0.340 / 1M $1.200 / 1M
Общее число входных токенов 94,969 96,355
Выходные токены 34,399 8,213
Токены рассуждений 233,022 18,073
Время ответа (среднее) 78.59s 5.20s
Время ответа (макс.) 437.40s 19.44s
Время ответа (суммарно) 1571.84s 114.46s
Параметры 30.7B ~400B всего (~17B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Gemma 4 31B

medium
Стоимость
$0.002
Время
45.7s
Токены
2,696 tok

#167 GPT-5.6 Luna

low
Стоимость
$0.011
Время
10.2s
Токены
1,897 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

Быстрое сравнение

Сменить пару сравнения