Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Google: Gemini 3 Pro Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-17

Метрика Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low Релиз: 2026-03-03 Gemini 3 Pro Preview Gemini 3 Pro Preview medium Релиз: 2025-11-18
Ранг #17 #4
Оценка 8.0 8.7
Стабильность 10.0 10.0
Стоимость за результат 0.168 1.406
Общая стоимость $0.021 $0.197
Тестов верно
Доля успешных попыток 70.6% 82.4%
Нестабильные тесты 0 0
Всего запусков 51 51
Выходные токены 1,617 1,508
Токены рассуждений 7,686 10,084
Время ответа (среднее) 3.28s 9.06s
Время ответа (макс.) 11.91s 26.24s
Время ответа (суммарно) 55.80s 90.58s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 462 1,638
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 14.99s 149 1,485
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 225 762
Gemini 3 Pro Preview 3.0 10.0 0.0% 0 10.37s 351 952
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 291 696
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 10.84s 279 3,156
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 18 1,212
Gemini 3 Pro Preview 5.3 10.0 33.3% 0 7.01s 15 1,195
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 69 384
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 9.34s 78 374
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 72 753
Gemini 3 Pro Preview 9.8 10.0 100.0% 0 3.26s 69 754
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.76s 243 1,248
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 3.91s 243 1,197
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 237 993
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 11.96s 324 971

Быстрое сравнение

Сменить пару сравнения