Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Google: Gemma 4 31B

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-02

Метрика Gemini 3 Flash Preview Gemini 3 Flash Preview medium Релиз: 2025-12-17 Gemma 4 31B Gemma 4 31B medium Релиз: 2026-04-02
Оценка 10.0 8.6
Ранг #1 #5
Стабильность 10.0 9.6
Тестов верно
Доля успешных попыток 100.0% 80.4%
Нестабильные тесты 0 1
Всего запусков 51 51
Стоимость за результат 0.972 0.109
Общая стоимость $0.166 $0.015
???? ????? $0.500 / 1M $0.140 / 1M
???? ?????? $3.000 / 1M $0.400 / 1M
Выходные токены 1,640 9,568
Токены рассуждений 48,270 22,501
Время ответа (среднее) 11.39s 21.81s
Время ответа (макс.) 50.16s 68.92s
Время ответа (суммарно) 113.86s 327.16s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.13s 305 3,490
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 962 2,046
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 50.16s 351 12,645
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.72s 279 5,333
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 1,822 2,951
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 21.12s 12 14,908
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 4,349 8,985
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.09s 111 1,285
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 105 888
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.10s 72 4,558
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 533 2,035
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.43s 276 4,921
Gemma 4 31B 8.8 7.9 88.9% 1 27.63s 1,797 5,596
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 10.55s 234 1,130
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0

Быстрое сравнение

Сменить пару сравнения