Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Google: Gemma 4 31B

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-02

Метрика Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Релиз: 2026-03-03 Gemma 4 31B Gemma 4 31B medium Релиз: 2026-04-02
Оценка 8.1 8.6
Ранг #17 #5
Стабильность 10.0 9.6
Тестов верно
Доля успешных попыток 70.6% 80.4%
Нестабильные тесты 0 1
Всего запусков 51 51
Стоимость за результат 0.413 0.109
Общая стоимость $0.050 $0.015
???? ????? $0.250 / 1M $0.140 / 1M
???? ?????? $1.500 / 1M $0.400 / 1M
Выходные токены 1,737 9,568
Токены рассуждений 26,346 22,501
Время ответа (среднее) 3.70s 21.81s
Время ответа (макс.) 14.93s 68.92s
Время ответа (суммарно) 62.97s 327.16s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 9.1 10.0 75.0% 0 2.33s 570 4,305
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 962 2,046
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 14.93s 327 7,347
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.29s 279 2,952
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 1,822 2,951
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 4.21s 18 5,325
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 4,349 8,985
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.16s 96 1,488
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 105 888
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.91s 72 2,121
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 533 2,035
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 7.7 10.0 66.7% 0 3.58s 141 1,896
Gemma 4 31B 8.8 7.9 88.9% 1 27.63s 1,797 5,596
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.80s 234 912
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0

Быстрое сравнение

Сменить пару сравнения