AI BENCHY Compare

Google: Gemini 3.5 Flash vs Qwen: Qwen3.6 Plus

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика	Gemini 3.5 Flash Gemini 3.5 Flash minimal Релиз: 2026-05-19	Qwen3.6 Plus Qwen3.6 Plus medium Релиз: 2026-04-20

Метрика	Gemini 3.5 Flash Gemini 3.5 Flash minimal Релиз: 2026-05-19	Qwen3.6 Plus Qwen3.6 Plus medium Релиз: 2026-04-20
Оценка	8.1	7.9
Ранг	#21	#33
Надежность	10.0	10.0
Стабильность	9.6	9.6
Тестов верно
Доля успешных попыток	75.4%	70.2%
Нестабильные тесты	1	1
Всего запусков	57	57
Стоимость за результат	0.494	0.118
Общая стоимость	$0.070	$0.016
???? ?????	$1.500 / 1M	$0.325 / 1M
???? ??????	$9.000 / 1M	$1.950 / 1M
Выходные токены	2,262	1,784
Токены рассуждений	0	91,543
Время ответа (среднее)	1.37s	17.06s
Время ответа (макс.)	3.56s	47.51s
Время ответа (суммарно)	26.04s	307.07s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	6.5	10.0	50.0%	0		892ms	405	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		9.90s	207	7,557

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	10.0	10.0	100.0%	0		1.28s	441	0
Qwen3.6 Plus	3.0	10.0	0.0%	0		0ms	0	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	3.0	10.0	0.0%	0		3.56s	404	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		34.95s	452	13,073

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	10.0	10.0	100.0%	0		1.66s	279	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		14.95s	270	10,706

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	10.0	10.0	100.0%	0		899ms	12	0
Qwen3.6 Plus	2.9	7.2	11.1%	1		29.59s	56	33,464

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	10.0	10.0	100.0%	0		922ms	117	0
Qwen3.6 Plus	5.1	10.0	0.0%	0		27.05s	111	5,232

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	6.4	5.8	66.7%	1		893ms	76	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		7.54s	102	5,552

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	10.0	10.0	100.0%	0		1.45s	282	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		6.11s	298	6,868

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.79s	234	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		5.87s	267	1,330

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Gemini 3.5 Flash	3.0	10.0	0.0%	0		1.76s	12	0
Qwen3.6 Plus	3.0	10.0	0.0%	0		47.51s	21	7,761

Быстрое сравнение

Сменить пару сравнения

Gemini 3.5 FlashminimalvsQwen3.5-27Bmedium Gemini 3.5 FlashminimalvsMiMo-V2.5-Promedium Gemini 3 Flash PreviewnonevsQwen3.6 Plusmedium Gemini 3.5 FlashminimalvsGLM 5medium Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 Plusmedium Gemini 3.5 FlashminimalvsGLM 5 Turbomedium Gemini 3.5 FlashminimalvsQwen3.6 35B A3Bmedium Gemini 3.5 FlashminimalvsGPT-5.3-Codexmedium Gemini 3.5 FlashminimalvsQwen3.5 Plus 2026-02-15medium Seed-2.0-LitemediumvsGemini 3.5 Flashminimal Gemini 3.5 FlashminimalvsGrok 4.3medium Gemini 3.5 FlashminimalvsGPT-5.4medium