Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Z.ai: GLM 5 Turbo

Сводка

Сравнение benchmark Claude Opus 4.8 vs GLM 5 Turbo: GLM 5 Turbo лидирует по среднему баллу: 8.4 vs 7.2. GLM 5 Turbo имеет более низкую стоимость benchmark: $0.323 vs $0.539. Claude Opus 4.8 быстрее: 3.47s vs 23.00s, с долей успешных попыток 61.9% vs 74.6%.

Рекомендуемая модель: GLM 5 Turbo - Здесь у него лучший балл (8.4), при этом он примерно в 1.7 раза дешевле, чем Claude Opus 4.8.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-12

Метрика Claude Opus 4.8 Claude Opus 4.8 none Релиз: 2026-05-28 GLM 5 Turbo GLM 5 Turbo medium Релиз: 2026-03-15
Оценка 7.2 8.4
Ранг #59 #24
Надежность 10.0 10.0
Стабильность 9.2 8.5
Тестов верно
Доля успешных попыток 61.9% 74.6%
Нестабильные тесты 2 4
Всего запусков 63 63
Стоимость за результат 4.485 2.011
Общая стоимость $0.539 $0.323
Цена входа $5.000 / 1M $1.200 / 1M
Цена выхода $25.000 / 1M $4.000 / 1M
Общее число входных токенов 67,104 35,593
Выходные токены 8,107 12,245
Токены рассуждений 0 62,277
Время ответа (среднее) 3.47s 23.00s
Время ответа (макс.) 17.73s 194.23s
Время ответа (суммарно) 72.90s 482.97s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 4.8

none
Cost
$0.053
Time
22.0s
Tokens
2,253 tok

#24 GLM 5 Turbo

medium
Cost
$0.074
Time
206.0s
Tokens
18,549 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 834 1,472 0
GLM 5 Turbo 10.0 10.0 100.0% 0 4.82s 555 362 3,137
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
GLM 5 Turbo 8.2 9.3 66.7% 0 45.90s 5,941 363 25,381
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 29,658 3,259 0
GLM 5 Turbo 10.0 10.0 100.0% 0 13.88s 12,714 390 2,037
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 10,503 308 0
GLM 5 Turbo 10.0 10.0 100.0% 0 6.19s 7,107 577 3,632
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 975 61 0
GLM 5 Turbo 2.9 4.4 22.2% 2 71.07s 489 9,665 19,279
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 708 230 0
GLM 5 Turbo 6.1 3.1 66.7% 1 10.05s 477 60 2,216
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 909 95 0
GLM 5 Turbo 10.0 10.0 100.0% 0 5.38s 636 255 2,183
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 894 783 0
GLM 5 Turbo 8.7 7.9 77.8% 1 5.23s 609 312 2,647
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 11,775 355 0
GLM 5 Turbo 10.0 10.0 100.0% 0 9.84s 6,879 241 446
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 258 212 0
GLM 5 Turbo 3.0 10.0 0.0% 0 40.17s 186 20 1,319

Быстрое сравнение

Сменить пару сравнения