Qwen: Qwen3.5-9B vs Z.ai: GLM 4.7 Flash

GLM 4.7 Flash (medium) лидирует по среднему баллу: 4.3 vs 3.8. Qwen3.5-9B (medium) имеет более низкую стоимость benchmark: $0.036 vs $0.166. Qwen3.5-9B (medium) быстрее: 82.24s vs 142.59s, с долей успешных попыток 25.8% vs 31.8%.

Рекомендуемая модельGLM 4.7 Flash (medium)У него самый высокий балл в этом сравнении (4.3) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика	Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02	GLM 4.7 Flash GLM 4.7 Flash medium Релиз: 2026-01-19

Метрика	Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02	GLM 4.7 Flash GLM 4.7 Flash medium Релиз: 2026-01-19
Оценка	3.8	4.3
Ранг	#220	#210
Надежность	5.0	7.8
Стабильность	8.1	7.0
Тестов верно
Доля успешных попыток	25.8%	31.8%
Нестабильные тесты	5	8
Всего запусков	66	66
Стоимость за результат	1.187	4.147
Общая стоимость	$0.036	$0.166
Цена входа	$0.100 / 1M	$0.060 / 1M
Цена выхода	$0.150 / 1M	$0.400 / 1M
Общее число входных токенов	17,070	79,051
Выходные токены	29,045	43,754
Токены рассуждений	209,516	374,109
Время ответа (среднее)	82.24s	142.59s
Время ответа (макс.)	226.38s	1539.97s
Время ответа (суммарно)	1315.88s	1996.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 Qwen3.5-9B

medium

Стоимость: $0.001
Время: 35.9s
Токены: 3,030 tok

#210 GLM 4.7 Flash

medium

Неверный SVG

Стоимость: $0.000
Время: 186.2s
Токены: 12,112 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Категория:

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	5.1	5.8	50.0%	2		34.44s	369	2,621	12,411
GLM 4.7 Flash	4.7	5.9	41.7%	2		14.95s	555	1,122	6,110

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	2.9	10.0	0.0%	0		100.88s	2,396	7,890	41,129
GLM 4.7 Flash	3.2	7.4	11.1%	1		55.33s	3,106	4,981	22,387

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	3.0	10.0	0.0%	0		0ms	0	0	0
GLM 4.7 Flash	2.9	6.0	16.7%	1		802.77s	59,030	2,585	305,678

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	3.6	5.6	33.3%	1		87.31s	4,722	1,383	32,113
GLM 4.7 Flash	6.3	10.0	50.0%	0		1.51s	7,107	584	2,755

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	3.6	7.2	22.2%	1		137.75s	295	11,549	48,475
GLM 4.7 Flash	3.5	4.4	33.3%	2		174.55s	643	33,000	25,394

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	2.8	1.6	33.3%	1		226.38s	180	0	30,695
GLM 4.7 Flash	3.6	9.7	0.0%	0		18.14s	318	18	2,138

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	6.5	10.0	50.0%	0		5.75s	381	491	1,824
GLM 4.7 Flash	6.2	5.8	66.7%	1		2.97s	636	388	2,181

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	3.0	10.0	0.0%	0		32.27s	376	1,593	12,026
GLM 4.7 Flash	2.9	7.2	11.1%	1		12.93s	521	781	5,255

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	10.0	10.0	100.0%	0		4.31s	8,283	444	1,149
GLM 4.7 Flash	10.0	10.0	100.0%	0		15.95s	6,949	224	1,014

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-9B	3.0	10.0	0.0%	0		177.02s	68	3,074	29,694
GLM 4.7 Flash	3.0	10.0	0.0%	0		11.13s	186	71	1,197

Быстрое сравнение

Сменить пару сравнения