AI BENCHY Compare

Qwen: Qwen3.5-9B vs Z.ai: GLM 5 Turbo

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-15

Метрика	Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02	GLM 5 Turbo GLM 5 Turbo none Релиз: 2026-03-15

Метрика	Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02	GLM 5 Turbo GLM 5 Turbo none Релиз: 2026-03-15
Ранг	#65	#53
Оценка	4.6	5.7
Стабильность	7.4	9.5
Стоимость за результат	0.779	0.467
Общая стоимость	$0.024	$0.028
Тестов верно
Доля успешных попыток	35.4%	39.6%
Нестабильные тесты	5	1
Всего запусков	48	48
Выходные токены	17,930	1,264
Токены рассуждений	139,706	0
Время ответа (среднее)	71.44s	2.92s
Время ответа (макс.)	226.38s	8.21s
Время ответа (суммарно)	928.77s	46.72s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	5.9	7.2	55.6%	1		31.54s	2,410	10,913
GLM 5 Turbo	3.0	10.0	0.0%	0		3.01s	376	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	3.0	10.0	0.0%	0		0ms	0	0
GLM 5 Turbo	3.0	10.0	0.0%	0		4.89s	144	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	3.6	5.6	33.3%	1		87.31s	1,383	32,113
GLM 5 Turbo	10.0	10.0	100.0%	0		2.47s	204	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	3.6	7.2	22.2%	1		137.75s	11,549	48,475
GLM 5 Turbo	5.3	10.0	33.3%	0		1.97s	25	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	2.8	1.6	33.3%	1		226.38s	0	30,695
GLM 5 Turbo	4.2	9.9	0.0%	0		2.18s	48	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	6.4	5.8	66.7%	1		17.15s	599	4,517
GLM 5 Turbo	6.5	10.0	50.0%	0		2.13s	65	0

Puzzle Solving	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	3.1	10.0	0.0%	0		33.38s	1,545	11,844
GLM 5 Turbo	5.5	7.4	44.4%	1		2.43s	180	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	10.0	10.0	100.0%	0		4.31s	444	1,149
GLM 5 Turbo	10.0	10.0	100.0%	0		8.21s	222	0

Быстрое сравнение

Сменить пару сравнения

Qwen3.5-9BmediumvsGrok 4.1 Fastnone Qwen3.5-9BmediumvsMiMo-V2-Flashnone MiniMax M2.5mediumБесплатно доступноvsGLM 5 Turbonone Grok 4.20 Multi-Agent BetamediumvsGLM 5 Turbonone Nemotron 3 Super 120b A12bnoneБесплатно доступноvsQwen3.5-9Bmedium Mercury 2nonevsQwen3.5-9Bmedium gpt-oss-120bmediumБесплатно доступноvsGLM 5 Turbonone GPT-4o-mininonevsQwen3.5-9Bmedium Qwen3.5-9BmediumvsGLM 4.7 Flashnone GPT-5 NanomediumvsGLM 5 Turbonone Mercury 2mediumvsGLM 5 Turbonone Trinity Large PreviewnoneБесплатно доступноvsQwen3.5-9Bmedium