Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.5 Flash vs Qwen: Qwen3.7 Max

Сводка

Сравнение benchmark Gemini 3.5 Flash vs Qwen3.7 Max: Qwen3.7 Max лидирует по среднему баллу: 9.4 vs 9.1. Qwen3.7 Max имеет более низкую стоимость benchmark: $0.523 vs $0.582. Gemini 3.5 Flash быстрее: 4.94s vs 16.02s, с долей успешных попыток 87.3% vs 88.9%.

Рекомендуемая модель: Gemini 3.5 Flash - Его балл близок к лучшему здесь (9.1 против 9.4), и он отвечает примерно в 3.2 раза быстрее, чем Qwen3.7 Max.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-12

Метрика Gemini 3.5 Flash Gemini 3.5 Flash medium Релиз: 2026-05-19 Qwen3.7 Max Qwen3.7 Max medium Релиз: 2026-05-22
Оценка 9.1 9.4
Ранг #11 #4
Надежность 10.0 10.0
Стабильность 9.6 9.6
Тестов верно
Доля успешных попыток 87.3% 88.9%
Нестабильные тесты 1 1
Всего запусков 63 63
Стоимость за результат 3.229 5.517
Общая стоимость $0.582 $0.523
Цена входа $1.500 / 1M $1.250 / 1M
Цена выхода $9.000 / 1M $3.750 / 1M
Общее число входных токенов 36,936 42,360
Выходные токены 2,001 2,129
Токены рассуждений 56,408 122,959
Время ответа (среднее) 4.94s 16.02s
Время ответа (макс.) 18.07s 59.98s
Время ответа (суммарно) 103.79s 336.51s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Gemini 3.5 Flash

medium
Cost
$0.201
Time
112.9s
Tokens
22,371 tok

#4 Qwen3.7 Max

medium
Cost
$0.017
Time
68.8s
Tokens
4,526 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.09s 492 171 3,385
Qwen3.7 Max 10.0 10.0 100.0% 0 6.36s 672 222 8,742
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.9 7.5 77.8% 1 12.63s 8,118 461 24,939
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 12.05s 12,873 351 7,807
Qwen3.7 Max 10.0 10.0 100.0% 0 19.60s 14,934 366 8,405
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 4.07s 7,548 279 3,784
Qwen3.7 Max 10.0 10.0 100.0% 0 8.80s 7,782 270 6,254
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.7 10.0 66.7% 0 5.24s 633 12 8,047
Qwen3.7 Max 5.9 7.2 55.6% 1 24.94s 771 61 31,793
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 486 115 1,144
Qwen3.7 Max 10.0 10.0 100.0% 0 11.70s 516 135 4,457
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 9.9 10.0 100.0% 0 2.70s 615 71 2,855
Qwen3.7 Max 10.0 10.0 100.0% 0 7.46s 699 102 5,452
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.7 10.0 66.7% 0 2.38s 558 295 2,747
Qwen3.7 Max 10.0 10.0 100.0% 0 8.84s 696 259 8,908
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.81s 5,457 234 455
Qwen3.7 Max 10.0 10.0 100.0% 0 6.63s 8,193 267 1,220
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.75s 156 12 1,245
Qwen3.7 Max 3.0 10.0 0.0% 0 33.37s 204 24 12,920

Быстрое сравнение

Сменить пару сравнения