AI BENCHY Compare

Qwen: Qwen3.5-27B vs Z.ai: GLM 5

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-14

Метрика	Qwen3.5-27B Qwen3.5-27B medium Релиз: 2026-02-24	GLM 5 GLM 5 none Релиз: 2026-02-12

Метрика	Qwen3.5-27B Qwen3.5-27B medium Релиз: 2026-02-24	GLM 5 GLM 5 none Релиз: 2026-02-12
Оценка	8.4	6.6
Ранг	#8	#50
Стабильность	8.8	9.6
Тестов верно
Доля успешных попыток	81.5%	51.9%
Нестабильные тесты	3	1
Всего запусков	54	54
Стоимость за результат	3.822	0.217
Общая стоимость	$0.497	$0.020
???? ?????	$0.195 / 1M	$0.720 / 1M
???? ??????	$1.560 / 1M	$2.300 / 1M
Выходные токены	2,500	1,959
Токены рассуждений	242,500	0
Время ответа (среднее)	53.03s	4.23s
Время ответа (макс.)	163.96s	11.07s
Время ответа (суммарно)	954.46s	46.51s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-27B	8.7	7.9	91.7%	1		19.75s	569	31,505
GLM 5	4.8	10.0	25.0%	0		2.37s	275	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-27B	10.0	10.0	100.0%	0		70.35s	375	19,165
GLM 5	5.6	3.5	33.3%	1		8.84s	408	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-27B	10.0	10.0	100.0%	0		163.96s	483	9,991
GLM 5	3.0	10.0	0.0%	0		4.98s	406	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-27B	10.0	10.0	100.0%	0		30.26s	270	16,150
GLM 5	10.0	10.0	100.0%	0		5.78s	203	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-27B	5.3	10.0	33.3%	0		79.53s	43	52,368
GLM 5	3.0	10.0	0.0%	0		2.24s	19	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-27B	6.1	3.1	66.7%	1		101.41s	70	23,147
GLM 5	10.0	10.0	100.0%	0		3.27s	103	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-27B	10.0	10.0	100.0%	0		19.66s	97	11,638
GLM 5	10.0	10.0	100.0%	0		1.48s	61	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-27B	8.2	7.7	77.8%	1		64.61s	245	77,213
GLM 5	7.7	10.0	66.7%	0		2.05s	264	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.5-27B	10.0	10.0	100.0%	0		7.45s	348	1,323
GLM 5	10.0	10.0	100.0%	0		11.07s	220	0

Быстрое сравнение

Сменить пару сравнения

Grok 4.1 FastmediumvsGLM 5none Nemotron 3 SupermediumБесплатно доступноvsGLM 5none Mercury 2mediumvsGLM 5none Gemini 3 Flash PreviewnonevsQwen3.5-27Bmedium Grok 4.20mediumvsGLM 5none Gemini 3.1 Flash Lite PreviewlowvsQwen3.5-27Bmedium Kimi K2.5mediumvsGLM 5none Gemini 3 Flash PreviewlowvsQwen3.5-27Bmedium GPT-5 MinimediumvsGLM 5none GPT-5 NanomediumvsGLM 5none GPT-5.2 ChatnonevsQwen3.5-27Bmedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5-27Bmedium