Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Z.ai: GLM 5

Сводка

Сравнение benchmark Claude Sonnet 4.6 vs GLM 5: GLM 5 лидирует по среднему баллу: 8.6 vs 7.3. GLM 5 имеет более низкую стоимость benchmark: $0.228 vs $0.316. Claude Sonnet 4.6 быстрее: 5.04s vs 33.54s, с долей успешных попыток 55.6% vs 82.5%.

Рекомендуемая модель: GLM 5 - У него самый высокий балл в этом сравнении (8.6) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Claude Sonnet 4.6 Claude Sonnet 4.6 none Релиз: 2026-02-17 GLM 5 GLM 5 medium Релиз: 2026-02-12
Оценка 7.3 8.6
Ранг #55 #15
Надежность 10.0 10.0
Стабильность 9.7 8.5
Тестов верно
Доля успешных попыток 55.6% 82.5%
Нестабильные тесты 1 4
Всего запусков 63 63
Стоимость за результат 2.870 1.668
Общая стоимость $0.316 $0.228
Цена входа $3.000 / 1M $0.600 / 1M
Цена выхода $15.000 / 1M $1.920 / 1M
Общее число входных токенов 57,886 35,224
Выходные токены 9,465 21,570
Токены рассуждений 0 102,996
Время ответа (среднее) 5.04s 33.54s
Время ответа (макс.) 23.84s 99.85s
Время ответа (суммарно) 70.60s 435.99s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#55 Claude Sonnet 4.6

none
Стоимость
$0.038
Время
27.3s
Токены
2,598 tok

#15 GLM 5

medium
Стоимость
$0.005
Время
20.7s
Токены
2,068 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 636 1,214 0
GLM 5 10.0 10.0 100.0% 0 23.66s 555 480 7,056
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 26,024 3,766 0
GLM 5 10.0 10.0 100.0% 0 28.96s 12,804 662 3,242
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 8,574 252 0
GLM 5 7.1 5.6 83.3% 1 8.90s 5,508 567 3,734
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 759 413 0
GLM 5 3.5 4.4 33.3% 2 0ms 260 13,176 14,137
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 513 192 0
GLM 5 6.1 3.1 66.7% 1 14.69s 477 2,020 2,248
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 690 90 0
GLM 5 10.0 10.0 100.0% 0 7.25s 636 1,001 2,129
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.53s 663 533 0
GLM 5 10.0 10.0 100.0% 0 11.33s 609 33 4,076
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 11,301 447 0
GLM 5 10.0 10.0 100.0% 0 15.93s 6,935 233 994
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 204 431 0
GLM 5 3.0 10.0 0.0% 0 67.37s 186 401 12,450

Быстрое сравнение

Сменить пару сравнения