AI BENCHY Compare

OpenAI: GPT-5.5 vs Z.ai: GLM 5V Turbo

Сводка

Сравнение benchmark GPT-5.5 vs GLM 5V Turbo: GPT-5.5 лидирует по среднему баллу: 9.3 vs 7.3. GLM 5V Turbo имеет более низкую стоимость benchmark: $0.457 vs $0.907. GPT-5.5 быстрее: 9.76s vs 23.08s, с долей успешных попыток 85.7% vs 68.3%.

Рекомендуемая модель: GPT-5.5 - Здесь у него лучший балл (9.3), и он отвечает примерно в 2.4 раза быстрее, чем GLM 5V Turbo.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-02

Метрика	GPT-5.5 GPT-5.5 low Релиз: 2026-04-24	GLM 5V Turbo GLM 5V Turbo medium Релиз: 2026-04-01

Метрика	GPT-5.5 GPT-5.5 low Релиз: 2026-04-24	GLM 5V Turbo GLM 5V Turbo medium Релиз: 2026-04-01
Оценка	9.3	7.3
Ранг	#4	#58
Надежность	10.0	10.0
Стабильность	10.0	7.9
Тестов верно
Доля успешных попыток	85.7%	68.3%
Нестабильные тесты	0	6
Всего запусков	63	63
Стоимость за результат	5.035	4.151
Общая стоимость	$0.907	$0.457
Цена входа	$5.000 / 1M	$1.200 / 1M
Цена выхода	$30.000 / 1M	$4.000 / 1M
Общее число входных токенов	34,209	44,615
Выходные токены	2,046	2,347
Токены рассуждений	22,460	98,415
Время ответа (среднее)	9.76s	23.08s
Время ответа (макс.)	56.19s	95.88s
Время ответа (суммарно)	204.92s	484.63s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#4 GPT-5.5

low

Стоимость: $0.068
Время: 37.0s
Токены: 2,339 tok

#58 GLM 5V Turbo

medium

Неверный SVG

Стоимость: $0.000
Время: 300.0s
Токены: 0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	10.0	10.0	100.0%	0		4.41s	606	238	1,020
GLM 5V Turbo	7.2	6.1	75.0%	2		10.76s	555	587	7,872

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	10.0	10.0	100.0%	0		15.04s	7,302	423	6,402
GLM 5V Turbo	6.0	7.2	55.6%	1		63.38s	7,256	440	37,873

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	10.0	10.0	100.0%	0		9.56s	11,019	303	717
GLM 5V Turbo	6.9	3.8	66.7%	1		15.06s	18,533	403	2,523

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	10.0	10.0	100.0%	0		3.28s	7,140	228	157
GLM 5V Turbo	10.0	10.0	100.0%	0		9.60s	7,107	236	4,333

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	5.3	10.0	33.3%	0		28.05s	723	69	11,609
GLM 5V Turbo	5.3	7.2	44.4%	1		38.15s	687	32	29,035

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	10.0	10.0	100.0%	0		5.17s	477	133	245
GLM 5V Turbo	10.0	10.0	100.0%	0		11.09s	477	131	2,183

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	9.9	10.0	100.0%	0		3.74s	660	93	415
GLM 5V Turbo	9.9	10.0	100.0%	0		3.74s	636	72	1,813

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	10.0	10.0	100.0%	0		4.74s	642	279	954
GLM 5V Turbo	7.7	10.0	66.7%	0		10.24s	609	131	4,496

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	10.0	10.0	100.0%	0		4.96s	5,445	250	101
GLM 5V Turbo	7.0	3.7	66.7%	1		12.53s	8,569	293	765

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
GPT-5.5	3.0	10.0	0.0%	0		10.06s	195	30	840
GLM 5V Turbo	3.0	10.0	0.0%	0		40.96s	186	22	7,522

Быстрое сравнение

Сменить пару сравнения

GPT-5.5lowvsQwen3.7 Maxmedium Claude Fable 5mediumvsGPT-5.5low Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Gemini 3.5 FlashmediumvsGPT-5.5low Gemini 3 Flash PreviewmediumvsGPT-5.5low GPT-5.5lowvsQwen3.6 Max Previewmedium Claude Opus 4.8mediumvsGPT-5.5low Gemini 3.5 FlashhighvsGPT-5.5low Claude Opus 4.7mediumvsGPT-5.5low GPT-5.5lowvsGLM 5.2medium GPT-5.5lowvsGLM 5medium Seed-2.0-LitemediumvsGPT-5.5low