Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Google: Gemini 3 Flash Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium Релиз: 2026-05-08 Gemini 3 Flash Preview Gemini 3 Flash Preview none Релиз: 2025-12-17
Оценка 7.9 7.9
Ранг #32 #34
Надежность 10.0 10.0
Стабильность 9.1 9.1
Тестов верно
Доля успешных попыток 71.9% 73.7%
Нестабильные тесты 2 2
Всего запусков 57 57
Стоимость за результат 0.452 0.157
Общая стоимость $0.059 $0.021
???? ????? $0.250 / 1M $0.500 / 1M
???? ?????? $1.500 / 1M $3.000 / 1M
Выходные токены 2,224 1,855
Токены рассуждений 32,034 0
Время ответа (среднее) 3.14s 1.61s
Время ответа (макс.) 10.87s 3.56s
Время ответа (суммарно) 59.62s 19.26s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 9.1 10.0 75.0% 0 2.39s 604 4,201
Gemini 3 Flash Preview 8.3 10.0 75.0% 0 1.25s 214 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 3.26s 429 2,712
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.59s 423 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 10.87s 327 7,401
Gemini 3 Flash Preview 4.7 1.6 66.7% 1 3.56s 350 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 279 2,845
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.41s 279 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 3.16s 15 5,165
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 963ms 18 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.60s 84 1,142
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 104 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 9.9 10.0 100.0% 0 2.59s 75 3,320
Gemini 3 Flash Preview 6.4 5.8 66.7% 1 1.58s 74 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 7.6 7.2 77.8% 1 1.95s 165 2,450
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.06s 144 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 4.55s 234 921
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 234 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 3.08s 12 1,877
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 1.07s 15 0

Быстрое сравнение

Сменить пару сравнения