Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Z.ai: GLM 5 Turbo

Сводка

Сравнение benchmark GPT-5.4 Mini vs GLM 5 Turbo: GLM 5 Turbo лидирует по среднему баллу: 8.4 vs 8.0. GLM 5 Turbo имеет более низкую стоимость benchmark: $0.323 vs $0.526. GPT-5.4 Mini быстрее: 22.34s vs 23.00s, с долей успешных попыток 73.0% vs 74.6%.

Рекомендуемая модель: GLM 5 Turbo - Здесь у него лучший балл (8.4), при этом он примерно в 1.6 раза дешевле, чем GPT-5.4 Mini.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-12

Метрика GPT-5.4 Mini GPT-5.4 Mini medium Релиз: 2026-03-17 GLM 5 Turbo GLM 5 Turbo medium Релиз: 2026-03-15
Оценка 8.0 8.4
Ранг #30 #24
Надежность 10.0 10.0
Стабильность 8.0 8.5
Тестов верно
Доля успешных попыток 73.0% 74.6%
Нестабильные тесты 5 4
Всего запусков 63 63
Стоимость за результат 4.381 2.011
Общая стоимость $0.526 $0.323
Цена входа $0.750 / 1M $1.200 / 1M
Цена выхода $4.500 / 1M $4.000 / 1M
Общее число входных токенов 34,116 35,593
Выходные токены 2,181 12,245
Токены рассуждений 108,937 62,277
Время ответа (среднее) 22.34s 23.00s
Время ответа (макс.) 138.75s 194.23s
Время ответа (суммарно) 469.20s 482.97s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 GPT-5.4 Mini

medium
Cost
$0.056
Time
95.5s
Tokens
12,464 tok

#24 GLM 5 Turbo

medium
Cost
$0.074
Time
206.0s
Tokens
18,549 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 606 296 2,876
GLM 5 Turbo 10.0 10.0 100.0% 0 4.82s 555 362 3,137
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
GLM 5 Turbo 8.2 9.3 66.7% 0 45.90s 5,941 363 25,381
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 11,019 317 4,317
GLM 5 Turbo 10.0 10.0 100.0% 0 13.88s 12,714 390 2,037
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 7,140 234 650
GLM 5 Turbo 10.0 10.0 100.0% 0 6.19s 7,107 577 3,632
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 619 60 43,286
GLM 5 Turbo 2.9 4.4 22.2% 2 71.07s 489 9,665 19,279
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 477 150 510
GLM 5 Turbo 6.1 3.1 66.7% 1 10.05s 477 60 2,216
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 9.8 10.0 100.0% 0 2.13s 660 96 1,185
GLM 5 Turbo 10.0 10.0 100.0% 0 5.38s 636 255 2,183
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 7.8 10.0 66.7% 0 4.37s 642 278 2,443
GLM 5 Turbo 8.7 7.9 77.8% 1 5.23s 609 312 2,647
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 5,453 251 2,594
GLM 5 Turbo 10.0 10.0 100.0% 0 9.84s 6,879 241 446
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 3.0 10.0 0.0% 0 30.10s 195 32 10,174
GLM 5 Turbo 3.0 10.0 0.0% 0 40.17s 186 20 1,319

Быстрое сравнение

Сменить пару сравнения