Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Qwen: Qwen3.7 Max

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-22

Метрика Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Релиз: 2026-05-08 Qwen3.7 Max Qwen3.7 Max medium Релиз: 2026-05-22
Оценка 7.4 9.0
Ранг #51 #5
Надежность 10.0 10.0
Стабильность 9.2 9.6
Тестов верно
Доля успешных попыток 65.0% 88.3%
Нестабильные тесты 2 1
Всего запусков 60 60
Стоимость за результат 0.217 5.540
Общая стоимость $0.026 $0.942
???? ????? $0.250 / 1M $2.500 / 1M
???? ?????? $1.500 / 1M $7.500 / 1M
Выходные токены 2,726 2,109
Токены рассуждений 8,951 110,285
Время ответа (среднее) 1.92s 13.83s
Время ответа (макс.) 5.66s 33.37s
Время ответа (суммарно) 38.45s 276.53s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 7.3 6.2 75.0% 2 1.84s 1,013 1,548
Qwen3.7 Max 10.0 10.0 100.0% 0 6.36s 222 8,742
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 6.8 10.0 50.0% 0 1.71s 465 763
Qwen3.7 Max 10.0 10.0 100.0% 0 22.98s 403 22,134
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 4.48s 348 975
Qwen3.7 Max 10.0 10.0 100.0% 0 19.60s 366 8,405
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.44s 291 697
Qwen3.7 Max 10.0 10.0 100.0% 0 8.80s 270 6,254
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 5.3 10.0 33.3% 0 1.52s 15 1,214
Qwen3.7 Max 5.9 7.2 55.6% 1 24.94s 61 31,793
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 1.37s 69 438
Qwen3.7 Max 10.0 10.0 100.0% 0 11.70s 135 4,457
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.52s 72 760
Qwen3.7 Max 10.0 10.0 100.0% 0 7.46s 102 5,452
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.40s 210 1,191
Qwen3.7 Max 10.0 10.0 100.0% 0 8.84s 259 8,908
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 5.66s 234 945
Qwen3.7 Max 10.0 10.0 100.0% 0 6.63s 267 1,220
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 1.46s 9 420
Qwen3.7 Max 3.0 10.0 0.0% 0 33.37s 24 12,920

Быстрое сравнение

Сменить пару сравнения