Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs Z.ai: GLM 5

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-02

Метрика GPT-5.2 Chat GPT-5.2 Chat none Релиз: 2025-12-11 GLM 5 GLM 5 medium Релиз: 2026-02-12
Оценка 7.9 8.2
Ранг #32 #19
Надежность 10.0 10.0
Стабильность 8.9 8.4
Тестов верно
Доля успешных попыток 73.3% 81.7%
Нестабильные тесты 3 4
Всего запусков 60 60
Стоимость за результат 2.703 1.676
Общая стоимость $0.352 $0.228
Цена входа $1.750 / 1M $0.600 / 1M
Цена выхода $14.000 / 1M $2.080 / 1M
Общее число входных токенов 31,593 32,626
Выходные токены 21,144 21,558
Токены рассуждений 0 95,772
Время ответа (среднее) 6.82s 32.67s
Время ответа (макс.) 38.52s 99.85s
Время ответа (суммарно) 136.34s 392.01s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 606 1,807 0
GLM 5 10.0 10.0 100.0% 0 23.66s 555 480 7,056
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 8.2 6.7 83.3% 1 8.05s 4,686 4,131 0
GLM 5 10.0 10.0 100.0% 0 89.47s 4,656 2,985 45,706
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 11,019 1,243 0
GLM 5 10.0 10.0 100.0% 0 28.96s 12,804 662 3,242
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 7,140 980 0
GLM 5 7.1 5.6 83.3% 1 8.90s 5,508 567 3,734
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 723 7,810 0
GLM 5 3.5 4.4 33.3% 2 0ms 260 13,176 14,137
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 477 335 0
GLM 5 6.1 3.1 66.7% 1 14.69s 477 2,020 2,248
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 9.8 10.0 100.0% 0 5.51s 660 1,441 0
GLM 5 10.0 10.0 100.0% 0 7.25s 636 1,001 2,129
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.10s 642 1,603 0
GLM 5 10.0 10.0 100.0% 0 11.33s 609 33 4,076
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 5,445 555 0
GLM 5 10.0 10.0 100.0% 0 15.93s 6,935 233 994
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 3.0 10.0 0.0% 0 6.89s 195 1,239 0
GLM 5 3.0 10.0 0.0% 0 67.37s 186 401 12,450

Быстрое сравнение

Сменить пару сравнения