Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-04-20 vs Qwen: Qwen3.6 Flash

Сводка

Сравнение benchmark Qwen3.5 Plus 2026-04-20 vs Qwen3.6 Flash: Qwen3.5 Plus 2026-04-20 лидирует по среднему баллу: 7.6 vs 7.5. Qwen3.6 Flash имеет более низкую стоимость benchmark: $0.288 vs $0.317. Qwen3.6 Flash быстрее: 19.25s vs 46.36s, с долей успешных попыток 66.7% vs 71.4%.

Рекомендуемая модель: Qwen3.6 Flash - Его балл близок к лучшему здесь (7.5 против 7.6), и он отвечает примерно в 2.4 раза быстрее, чем Qwen3.5 Plus 2026-04-20.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-10

Метрика Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Релиз: 2026-04-20 Qwen3.6 Flash Qwen3.6 Flash medium Релиз: 2026-04-20
Оценка 7.6 7.5
Ранг #37 #40
Надежность 10.0 10.0
Стабильность 9.0 8.1
Тестов верно
Доля успешных попыток 66.7% 71.4%
Нестабильные тесты 2 5
Всего запусков 63 63
Стоимость за результат 3.023 3.030
Общая стоимость $0.317 $0.288
Цена входа $0.300 / 1M $0.188 / 1M
Цена выхода $1.800 / 1M $1.125 / 1M
Общее число входных токенов 42,097 42,362
Выходные токены 2,280 2,995
Токены рассуждений 166,613 245,358
Время ответа (среднее) 46.36s 19.25s
Время ответа (макс.) 189.38s 122.87s
Время ответа (суммарно) 973.57s 404.20s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 Qwen3.5 Plus 2026-04-20

medium
Cost
$0.008
Time
76.7s
Tokens
4,355 tok

#40 Qwen3.6 Flash

medium
Invalid SVG
Cost
$0.008
Time
29.9s
Tokens
6,784 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 10.84s 672 215 7,748
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.10s 672 624 14,024
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 6.2 8.7 33.3% 0 125.25s 7,630 308 58,682
Qwen3.6 Flash 5.0 5.1 44.5% 2 42.85s 7,895 495 67,967
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 92.41s 14,934 483 17,490
Qwen3.6 Flash 10.0 10.0 100.0% 0 20.28s 14,934 483 13,839
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 38.32s 7,782 270 14,668
Qwen3.6 Flash 10.0 10.0 100.0% 0 9.65s 7,782 270 13,155
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 2.9 7.2 11.1% 1 53.10s 771 63 28,414
Qwen3.6 Flash 3.5 4.4 33.3% 2 14.65s 771 60 24,409
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 4.9 9.6 0.0% 0 25.30s 516 125 4,792
Qwen3.6 Flash 4.8 9.9 0.0% 0 9.88s 516 140 5,445
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 20.25s 699 103 7,689
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.05s 699 102 7,423
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 8.2 7.2 88.9% 1 17.67s 696 338 9,800
Qwen3.6 Flash 8.2 7.2 88.9% 1 6.29s 696 460 10,860
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 14.72s 8,193 348 2,164
Qwen3.6 Flash 10.0 10.0 100.0% 0 4.00s 8,193 335 1,188
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-04-20 3.0 10.0 0.0% 0 92.57s 204 27 15,166
Qwen3.6 Flash 3.0 10.0 0.0% 0 122.87s 204 26 87,048

Быстрое сравнение

Сменить пару сравнения