Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

xAI: Grok 4.20 vs Z.ai: GLM 5V Turbo

Сводка

Сравнение benchmark Grok 4.20 vs GLM 5V Turbo: Grok 4.20 лидирует по среднему баллу: 7.3 vs 7.3. GLM 5V Turbo имеет более низкую стоимость benchmark: $0.457 vs $0.609. GLM 5V Turbo быстрее: 23.08s vs 27.68s, с долей успешных попыток 63.5% vs 68.3%.

Рекомендуемая модель: GLM 5V Turbo - Он дает лучший общий компромисс: конкурентный балл (7.3), ниже стоимость, чем у Grok 4.20, и сбалансированное время ответа.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Grok 4.20 Grok 4.20 medium Релиз: 2026-03-31 GLM 5V Turbo GLM 5V Turbo medium Релиз: 2026-04-01
Оценка 7.3 7.3
Ранг #53 #56
Надежность 10.0 10.0
Стабильность 8.8 7.9
Тестов верно
Доля успешных попыток 63.5% 68.3%
Нестабильные тесты 3 6
Всего запусков 63 63
Стоимость за результат 8.309 4.151
Общая стоимость $0.609 $0.457
Цена входа $1.250 / 1M $1.200 / 1M
Цена выхода $2.500 / 1M $4.000 / 1M
Общее число входных токенов 44,433 44,615
Выходные токены 1,819 2,347
Токены рассуждений 219,524 98,415
Время ответа (среднее) 27.68s 23.08s
Время ответа (макс.) 199.66s 95.88s
Время ответа (суммарно) 581.26s 484.63s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 xAI: Grok 4.20

medium
Стоимость
$0.041
Время
110.3s
Токены
16,336 tok

#56 GLM 5V Turbo

medium
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 8.2 7.9 83.3% 1 3.95s 2,010 287 8,312
GLM 5V Turbo 7.2 6.1 75.0% 2 10.76s 555 587 7,872
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
GLM 5V Turbo 6.0 7.2 55.6% 1 63.38s 7,256 440 37,873
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 10.0 10.0 100.0% 0 17.40s 12,909 232 9,556
GLM 5V Turbo 6.9 3.8 66.7% 1 15.06s 18,533 403 2,523
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 10.0 10.0 100.0% 0 4.17s 7,761 180 5,333
GLM 5V Turbo 10.0 10.0 100.0% 0 9.60s 7,107 236 4,333
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 5.3 10.0 33.3% 0 27.03s 1,764 375 49,339
GLM 5V Turbo 5.3 7.2 44.4% 1 38.15s 687 32 29,035
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 3.9 2.6 33.3% 1 24.48s 825 65 6,440
GLM 5V Turbo 10.0 10.0 100.0% 0 11.09s 477 131 2,183
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 9.8 10.0 100.0% 0 4.26s 1,362 57 6,419
GLM 5V Turbo 9.9 10.0 100.0% 0 3.74s 636 72 1,813
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 7.7 10.0 66.7% 0 6.22s 1,689 149 7,913
GLM 5V Turbo 7.7 10.0 66.7% 0 10.24s 609 131 4,496
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 3.0 10.0 0.0% 0 13.68s 7,275 197 6,620
GLM 5V Turbo 7.0 3.7 66.7% 1 12.53s 8,569 293 765
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.20 3.0 10.0 0.0% 0 63.48s 531 9 16,442
GLM 5V Turbo 3.0 10.0 0.0% 0 40.96s 186 22 7,522

Быстрое сравнение

Сменить пару сравнения