AI BENCHY Compare

Qwen: Qwen3.6 27B vs Z.ai: GLM 5.1

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-22

Метрика	Qwen3.6 27B Qwen3.6 27B medium Релиз: 2026-04-20	GLM 5.1 GLM 5.1 none Релиз: 2026-04-07

Метрика	Qwen3.6 27B Qwen3.6 27B medium Релиз: 2026-04-20	GLM 5.1 GLM 5.1 none Релиз: 2026-04-07
Оценка	6.6	5.6
Ранг	#83	#113
Надежность	9.9	10.0
Стабильность	8.1	8.1
Тестов верно
Доля успешных попыток	58.3%	40.0%
Нестабильные тесты	5	5
Всего запусков	60	60
Стоимость за результат	3.015	0.941
Общая стоимость	$0.272	$0.057
???? ?????	$0.317 / 1M	$0.980 / 1M
???? ??????	$3.200 / 1M	$3.080 / 1M
Выходные токены	13,007	3,749
Токены рассуждений	105,697	0
Время ответа (среднее)	57.65s	4.16s
Время ответа (макс.)	168.22s	32.57s
Время ответа (суммарно)	1153.04s	83.23s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	8.3	10.0	75.0%	0		12.62s	582	4,311
GLM 5.1	4.0	6.3	25.0%	2		2.11s	305	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	6.6	10.0	50.0%	0		165.39s	4,760	26,668
GLM 5.1	4.3	9.5	0.0%	0		6.33s	519	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	7.0	3.7	66.7%	1		83.07s	2,088	14,689
GLM 5.1	2.8	2.1	33.3%	1		32.57s	2,129	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	3.5	1.4	50.0%	2		37.30s	568	9,404
GLM 5.1	10.0	10.0	100.0%	0		1.08s	204	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	2.9	7.2	11.1%	1		73.38s	3,510	20,352
GLM 5.1	2.9	7.2	11.1%	1		1.99s	24	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	6.5	3.4	66.7%	1		39.53s	81	3,045
GLM 5.1	5.0	10.0	0.0%	0		790ms	39	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	10.0	10.0	100.0%	0		37.96s	346	6,548
GLM 5.1	9.8	10.0	100.0%	0		1.58s	66	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	7.7	10.0	66.7%	0		60.21s	281	11,919
GLM 5.1	6.1	7.8	44.4%	1		1.48s	152	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	10.0	10.0	100.0%	0		16.88s	390	2,954
GLM 5.1	10.0	10.0	100.0%	0		10.68s	300	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Qwen3.6 27B	3.0	10.0	0.0%	0		80.99s	401	5,807
GLM 5.1	3.0	10.0	0.0%	0		2.34s	11	0

Быстрое сравнение

Сменить пару сравнения

gpt-oss-120bmediumБесплатно доступноvsGLM 5.1none Qwen3.6 27BmediumvsGrok Build 0.1none Gemini 3.1 Flash LitenonevsQwen3.6 27Bmedium GPT-5.5nonevsQwen3.6 27Bmedium DeepSeek V4 ProhighvsQwen3.6 27Bmedium Gemini 3.1 Flash LiteminimalvsQwen3.6 27Bmedium Gemma 4 31BnoneБесплатно доступноvsQwen3.6 27Bmedium MiniMax M2.5mediumБесплатно доступноvsGLM 5.1none CobuddymediumБесплатно доступноvsGLM 5.1none Mistral Small 4mediumvsGLM 5.1none Elephant AlphamediumvsGLM 5.1none Owl AlphamediumvsGLM 5.1none