Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-02-15 vs Z.ai: GLM 5

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-29

Метрика Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Релиз: 2026-02-15 GLM 5 GLM 5 medium Релиз: 2026-02-12
Оценка 8.1 8.2
Ранг #23 #20
Надежность 10.0 10.0
Стабильность 8.8 8.4
Тестов верно
Доля успешных попыток 76.7% 81.7%
Нестабильные тесты 3 4
Всего запусков 60 60
Стоимость за результат 2.251 1.676
Общая стоимость $0.316 $0.235
Цена входа $0.260 / 1M $0.600 / 1M
Цена выхода $1.560 / 1M $1.920 / 1M
Выходные токены 2,145 21,558
Токены рассуждений 172,563 95,772
Время ответа (среднее) 67.58s 32.67s
Время ответа (макс.) 266.69s 99.85s
Время ответа (суммарно) 878.57s 392.01s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 8.2 7.9 83.3% 1 45.78s 205 21,236
GLM 5 10.0 10.0 100.0% 0 23.66s 480 7,056
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 7.6 6.7 66.7% 1 193.80s 406 63,554
GLM 5 10.0 10.0 100.0% 0 89.47s 2,985 45,706
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.85s 421 7,906
GLM 5 10.0 10.0 100.0% 0 28.96s 662 3,242
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.91s 270 14,916
GLM 5 7.1 5.6 83.3% 1 8.90s 567 3,734
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 17.50s 35 16,680
GLM 5 3.5 4.4 33.3% 2 0ms 13,176 14,137
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 4.7 1.6 66.7% 1 79.86s 73 8,675
GLM 5 6.1 3.1 66.7% 1 14.69s 2,020 2,248
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 31.93s 101 7,704
GLM 5 10.0 10.0 100.0% 0 7.25s 1,001 2,129
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 32.50s 301 13,853
GLM 5 10.0 10.0 100.0% 0 11.33s 33 4,076
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 7.54s 309 909
GLM 5 10.0 10.0 100.0% 0 15.93s 233 994
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 103.81s 24 17,130
GLM 5 3.0 10.0 0.0% 0 67.37s 401 12,450

Быстрое сравнение

Сменить пару сравнения