AI BENCHY Compare

Qwen: Qwen3.5-9B vs Z.ai: GLM 4.7 Flash

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-12

Метрика	Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02	GLM 4.7 Flash GLM 4.7 Flash medium Релиз: 2026-01-19

Метрика	Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02	GLM 4.7 Flash GLM 4.7 Flash medium Релиз: 2026-01-19
Ранг	#66	#62
Средний балл	2.6	3.1
Стабильность	7.4	6.4
Стоимость за результат	0.779	1.040
Общая стоимость	$0.024	$0.042
Тестов верно
Доля успешных попыток	35.4%	41.7%
Нестабильные тесты	5	7
Всего запусков	48	48
Выходные токены	17,930	38,682
Токены рассуждений	139,706	64,952
Время ответа (среднее)	71.44s	36.84s
Время ответа (макс.)	226.38s	174.55s
Время ответа (суммарно)	928.77s	331.58s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Средний балл vs Время ответа (среднее)

Общее число выходных токенов

Средний балл vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	4.0	7.2	55.6%	1		31.54s	2,410	10,913
GLM 4.7 Flash	4.0	4.5	55.6%	2		27.09s	1,085	5,597

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	10.0	10.0	0.0%	0		0ms	0	0
GLM 4.7 Flash	10.0	2.1	33.3%	1		65.57s	2,585	20,648

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	5.0	5.6	33.3%	1		87.31s	1,383	32,113
GLM 4.7 Flash	5.0	10.0	50.0%	0		1.51s	584	2,755

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	10.0	7.2	22.2%	1		137.75s	11,549	48,475
GLM 4.7 Flash	10.0	4.4	33.3%	2		174.55s	33,000	25,394

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	10.0	1.6	33.3%	1		226.38s	0	30,695
GLM 4.7 Flash	10.0	9.7	0.0%	0		18.14s	18	2,138

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	5.5	5.8	66.7%	1		17.15s	599	4,517
GLM 4.7 Flash	5.0	5.8	66.7%	1		2.97s	388	2,181

Puzzle Solving	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	10.0	10.0	0.0%	0		33.38s	1,545	11,844
GLM 4.7 Flash	10.0	7.2	11.1%	1		12.90s	798	5,225

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-9B	10.0	10.0	100.0%	0		4.31s	444	1,149
GLM 4.7 Flash	10.0	10.0	100.0%	0		15.95s	224	1,014

Быстрое сравнение

Сменить пару сравнения

Grok 4.1 FastnonevsGLM 4.7 Flashmedium MiMo-V2-FlashnonevsGLM 4.7 Flashmedium Mercury 2nonevsGLM 4.7 Flashmedium Qwen3.5-9BnonevsGLM 4.7 Flashmedium Qwen3.5-9BmediumvsMiMo-V2-Flashnone Nemotron 3 Super 120b A12bnoneБесплатно доступноvsGLM 4.7 Flashmedium Qwen3.5-9BmediumvsGrok 4.1 Fastnone Mercury 2nonevsQwen3.5-9Bmedium Nemotron 3 Super 120b A12bnoneБесплатно доступноvsQwen3.5-9Bmedium Qwen3 Coder NextnonevsGLM 4.7 Flashmedium GPT-4o-mininonevsGLM 4.7 Flashmedium Kimi K2.5nonevsGLM 4.7 Flashmedium