AI BENCHY Compare

OpenAI: GPT-5.4 vs Z.ai: GLM 5 Turbo

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-15

Метрика	GPT-5.4 GPT-5.4 none Релиз: 2026-03-05	GLM 5 Turbo GLM 5 Turbo none Релиз: 2026-03-15

Метрика	GPT-5.4 GPT-5.4 none Релиз: 2026-03-05	GLM 5 Turbo GLM 5 Turbo none Релиз: 2026-03-15
Ранг	#51	#53
Оценка	5.8	5.7
Стабильность	8.9	9.5
Стоимость за результат	1.562	0.467
Общая стоимость	$0.094	$0.028
Тестов верно
Доля успешных попыток	41.7%	39.6%
Нестабильные тесты	2	1
Всего запусков	48	48
Выходные токены	1,819	1,264
Токены рассуждений	0	0
Время ответа (среднее)	1.48s	2.92s
Время ответа (макс.)	2.89s	8.21s
Время ответа (суммарно)	23.64s	46.72s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	3.2	7.3	11.1%	1		1.41s	388	0
GLM 5 Turbo	3.0	10.0	0.0%	0		3.01s	376	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	3.0	10.0	0.0%	0		2.89s	291	0
GLM 5 Turbo	3.0	10.0	0.0%	0		4.89s	144	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	10.0	10.0	100.0%	0		1.04s	222	0
GLM 5 Turbo	10.0	10.0	100.0%	0		2.47s	204	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	5.3	7.2	44.4%	1		1.07s	50	0
GLM 5 Turbo	5.3	10.0	33.3%	0		1.97s	25	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	4.4	9.9	0.0%	0		1.78s	184	0
GLM 5 Turbo	4.2	9.9	0.0%	0		2.18s	48	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	6.5	10.0	50.0%	0		1.07s	81	0
GLM 5 Turbo	6.5	10.0	50.0%	0		2.13s	65	0

Puzzle Solving	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	5.6	9.8	33.3%	0		1.52s	357	0
GLM 5 Turbo	5.5	7.4	44.4%	1		2.43s	180	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	10.0	10.0	100.0%	0		2.75s	246	0
GLM 5 Turbo	10.0	10.0	100.0%	0		8.21s	222	0

Быстрое сравнение

Сменить пару сравнения

MiniMax M2.5mediumБесплатно доступноvsGPT-5.4none MiniMax M2.5mediumБесплатно доступноvsGLM 5 Turbonone GPT-5.4nonevsGrok 4.20 Multi-Agent Betamedium Grok 4.20 Multi-Agent BetamediumvsGLM 5 Turbonone gpt-oss-120bmediumБесплатно доступноvsGLM 5 Turbonone Mercury 2mediumvsGPT-5.4none GPT-5 NanomediumvsGLM 5 Turbonone Mercury 2mediumvsGLM 5 Turbonone Qwen3 Coder NextmediumvsGLM 5 Turbonone GPT-5.4nonevsQwen3 Coder Nextmedium Nemotron 3 Super 120b A12bmediumБесплатно доступноvsGPT-5.4none GPT-5.4nonevsGLM 4.7 Flashmedium