Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs Google: Gemini 3.5 Flash

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика Gemini 3.5 Flash Gemini 3.5 Flash minimal Релиз: 2026-05-19 Gemini 3.5 Flash Gemini 3.5 Flash none Релиз: 2026-05-19
Оценка 8.1 9.1
Ранг #21 #6
Надежность 10.0 10.0
Стабильность 9.6 9.0
Тестов верно
Доля успешных попыток 75.4% 91.7%
Нестабильные тесты 1 2
Всего запусков 57 57
Стоимость за результат 0.494 3.490
Общая стоимость $0.070 $0.489
???? ????? $1.500 / 1M $1.500 / 1M
???? ?????? $9.000 / 1M $9.000 / 1M
Выходные токены 2,262 53,202
Токены рассуждений 0 0
Время ответа (среднее) 1.37s 5.59s
Время ответа (макс.) 3.56s 14.88s
Время ответа (суммарно) 26.04s 89.50s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 6.5 10.0 50.0% 0 892ms 405 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.53s 5,101 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.28s 441 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 14.88s 11,611 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 3.0 10.0 0.0% 0 3.56s 404 0
Gemini 3.5 Flash 0.0 0.0 0.0% 0 0ms 0 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.66s 279 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 8.10s 5,895 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 899ms 12 0
Gemini 3.5 Flash 7.6 7.2 77.8% 1 10.64s 17,910 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 922ms 117 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.46s 1,620 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 6.4 5.8 66.7% 1 893ms 76 0
Gemini 3.5 Flash 9.8 10.0 100.0% 0 3.38s 3,928 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.45s 282 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.13s 4,640 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.79s 234 0
Gemini 3.5 Flash 0.0 0.0 0.0% 0 0ms 0 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 3.0 10.0 0.0% 0 1.76s 12 0
Gemini 3.5 Flash 2.8 1.6 33.3% 1 4.87s 2,497 0

Быстрое сравнение

Сменить пару сравнения