Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs Google: Gemma 4 31B

Сводка

Сравнение benchmark Gemini 3.5 Flash vs Gemma 4 31B: Gemini 3.5 Flash лидирует по среднему баллу: 9.2 vs 6.1. Gemma 4 31B имеет более низкую стоимость benchmark: $0.004 vs $0.349. Gemini 3.5 Flash быстрее: 3.27s vs 4.05s, с долей успешных попыток 90.5% vs 47.6%.

Рекомендуемая модель: Gemini 3.5 Flash - У него самый высокий балл в этом сравнении (9.2) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Gemini 3.5 Flash Gemini 3.5 Flash low Релиз: 2026-05-19 Gemma 4 31B Gemma 4 31B none Релиз: 2026-04-02 Бесплатно доступно
Оценка 9.2 6.1
Ранг #5 #98
Надежность 10.0 10.0
Стабильность 10.0 10.0
Тестов верно
Доля успешных попыток 90.5% 47.6%
Нестабильные тесты 0 0
Всего запусков 63 63
Стоимость за результат 1.834 0.034
Общая стоимость $0.349 $0.004
Цена входа $1.500 / 1M $0.120 / 1M
Цена выхода $9.000 / 1M $0.350 / 1M
Общее число входных токенов 36,938 20,911
Выходные токены 2,033 1,407
Токены рассуждений 30,519 0
Время ответа (среднее) 3.27s 4.05s
Время ответа (макс.) 9.05s 26.13s
Время ответа (суммарно) 68.65s 76.87s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#5 Gemini 3.5 Flash

low
Стоимость
$0.068
Время
39.1s
Токены
7,588 tok

#98 Gemma 4 31B

none
Стоимость
$0.001
Время
12.8s
Токены
795 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 494 209 2,536
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 852 45 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.8 10.0 66.7% 0 6.71s 8,118 458 13,420
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 12,873 351 3,050
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 7,548 279 1,164
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 8,352 285 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 633 12 4,538
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 903 27 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 486 119 916
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 576 117 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 615 71 1,652
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 795 78 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 558 288 2,150
Gemma 4 31B 6.5 10.0 33.3% 0 4.23s 828 108 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 5,457 234 403
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 156 12 690
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 224 12 0

Быстрое сравнение

Сменить пару сравнения