Навигация
Advertise here

Grok 4.7 (low) vs GLM 5.1 (medium)

GLM 5.1 (medium) лидирует по среднему баллу: 7.5 vs 7.4. GLM 5.1 (medium) имеет более низкую стоимость benchmark: $1.066 vs $2.263. Grok 4.7 (low) быстрее: 63.19s vs 66.38s, с долей успешных попыток 73.9% vs 66.7%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#127
Общее число выходных токенов
255,329
Время ответа (среднее)
63.19s
Общая стоимость
$2.263
Ранг
#119
Общее число выходных токенов
248,708
Время ответа (среднее)
66.38s
Общая стоимость
$1.066
Рекомендуемая модель GLM 5.1 (medium)

Здесь у него лучший балл (7.5), при этом он примерно в 2.1 раза дешевле, чем Grok 4.7 (low).

Подробное сравнение

Метрика Grok 4.7 Grok 4.7 low Релиз: 2026-09-21 GLM 5.1 GLM 5.1 medium Релиз: 2026-04-07
Оценка 7.4 7.5
Ранг #127 #119
Надежность 10.0 9.2
Стабильность 8.3 8.4
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 73.9% 66.7%
Нестабильные тесты 5 4
Всего запусков 69 69
Стоимость за результат 13.804 9.004
Общая стоимость $2.263 $1.066
Цена входа $2.000 / 1M $0.965 / 1M
Цена выхода $6.000 / 1M $3.032 / 1M
Общее число входных токенов 365,119 331,577
Выходные токены 8,118 17,919
Токены рассуждений 247,211 230,789
Время ответа (среднее) 63.19s 66.38s
Время ответа (макс.) 389.63s 308.75s
Время ответа (суммарно) 1453.28s 1460.31s
Параметры ~1.7T всего (~170B активных) 744B всего (40B активных)
Доступность Закрытая модель Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#127 SpaceXAI: Grok 4.7

low
Стоимость
$0.007
Время
15.2s
Токены
1,537 tok

#119 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

Быстрое сравнение

Сменить пару сравнения