Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Laguna M.1

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-29

Метрика Gemini 3 Flash Preview Gemini 3 Flash Preview medium Релиз: 2025-12-17 Laguna M.1 Laguna M.1 medium Релиз: 2026-04-28 Бесплатно доступно
Оценка 10.0 6.3
Ранг #1 #74
Надежность Н/Д 10.0
Стабильность 10.0 8.6
Тестов верно
Доля успешных попыток 100.0% 53.7%
Нестабильные тесты 0 3
Всего запусков 18 54
Стоимость за результат 0.600 0.000
Общая стоимость $0.108 $0.000
???? ????? $0.500 / 1M $0.000 / 1M
???? ?????? $3.000 / 1M $0.000 / 1M
Выходные токены 655 63,822
Токены рассуждений 33,749 0
Время ответа (среднее) 12.11s 13.90s
Время ответа (макс.) 82.37s 53.14s
Время ответа (суммарно) 217.93s 250.28s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.26s 110 1,076
Laguna M.1 6.6 10.0 50.0% 0 9.15s 7,839 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 82.37s 144 16,257
Laguna M.1 4.3 1.1 66.7% 1 35.61s 14,327 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 23.58s 117 3,495
Laguna M.1 3.0 10.0 0.0% 0 53.14s 12,272 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 7.62s 93 2,197
Laguna M.1 10.0 10.0 100.0% 0 4.93s 2,296 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 14.81s 4 7,228
Laguna M.1 5.3 7.2 44.4% 1 24.14s 19,020 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.34s 24 635
Laguna M.1 4.1 10.0 0.0% 0 6.86s 1,294 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.30s 24 903
Laguna M.1 10.0 10.0 100.0% 0 4.30s 1,626 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.86s 61 1,455
Laguna M.1 3.6 7.2 22.2% 1 6.97s 3,978 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 9.78s 78 503
Laguna M.1 10.0 10.0 100.0% 0 6.31s 1,170 0

Быстрое сравнение

Сменить пару сравнения