Навигация
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

Qwen3.6 Max Preview (medium) лидирует по среднему баллу: 8.4 vs 8.0. GLM 5.2 (high) имеет более низкую стоимость benchmark: $0.970 vs $1.143. GLM 5.2 (high) быстрее: 62.65s vs 67.53s, с долей успешных попыток 80.3% vs 71.2%.

Рекомендуемая модельQwen3.6 Max Preview (medium)У него самый высокий балл в этом сравнении (8.4) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-20

Метрика Qwen3.6 Max Preview Qwen3.6 Max Preview medium Релиз: 2026-04-20 GLM 5.2 GLM 5.2 high Релиз: 2026-06-17
Оценка 8.4 8.0
Ранг #19 #31
Надежность 9.9 10.0
Стабильность 8.9 8.6
Тестов верно
Доля успешных попыток 80.3% 71.2%
Нестабильные тесты 3 3
Всего запусков 66 66
Стоимость за результат 8.173 5.873
Общая стоимость $1.143 $0.970
Цена входа $1.040 / 1M $0.960 / 1M
Цена выхода $6.240 / 1M $3.014 / 1M
Общее число входных токенов 79,240 83,813
Выходные токены 5,098 69,688
Токены рассуждений 164,842 225,659
Время ответа (среднее) 67.53s 62.65s
Время ответа (макс.) 238.07s 599.43s
Время ответа (суммарно) 1485.64s 1378.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 Qwen3.6 Max Preview

medium
Стоимость
$0.024
Время
76.5s
Токены
3,861 tok

#31 GLM 5.2

high
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

Быстрое сравнение

Сменить пару сравнения