Навигация
Advertise here

Qwen3.5-27B (medium) vs Grok 4.7 (xhigh)

Grok 4.7 (xhigh) лидирует по среднему баллу: 7.5 vs 7.5. Qwen3.5-27B (medium) имеет более низкую стоимость benchmark: $0.982 vs $2.625. Qwen3.5-27B (medium) быстрее: 113.28s vs 115.74s, с долей успешных попыток 75.8% vs 77.3%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-21

Сравниваемые модели

Ранг
#114
Общее число выходных токенов
614,909
Время ответа (среднее)
113.28s
Общая стоимость
$0.982
Ранг
#107
Общее число выходных токенов
505,069
Время ответа (среднее)
115.74s
Общая стоимость
$2.625
Рекомендуемая модель Qwen3.5-27B (medium)

Его балл близок к лучшему здесь (7.5 против 7.5), при этом он примерно в 2.7 раза дешевле, чем Grok 4.7 (xhigh).

Подробное сравнение

Метрика Qwen3.5-27B Qwen3.5-27B medium Релиз: 2026-02-24 Grok 4.7 Grok 4.7 xhigh Релиз: 2026-09-21
Оценка 7.5 7.5
Ранг #114 #107
Надежность 10.0 9.6
Стабильность 7.8 7.7
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 75.8% 77.3%
Нестабильные тесты 6 6
Всего запусков 66 66
Стоимость за результат 8.217 18.745
Общая стоимость $0.982 $2.625
Цена входа $0.195 / 1M $1.600 / 1M
Цена выхода $1.560 / 1M $4.800 / 1M
Общее число входных токенов 111,644 124,896
Выходные токены 16,113 4,890
Токены рассуждений 598,796 500,179
Время ответа (среднее) 113.28s 115.74s
Время ответа (макс.) 1026.43s 775.64s
Время ответа (суммарно) 2492.26s 2546.31s
Параметры 27B ~1.7T всего (~170B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 Qwen3.5-27B

medium
Стоимость
$0.008
Время
62.0s
Токены
3,099 tok

#107 SpaceXAI: Grok 4.7

xhigh
Стоимость
$0.235
Время
544.2s
Токены
39,247 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
Grok 4.7 5.3 4.5 55.6% 2 414.53s 10,168 327 256,935

Быстрое сравнение

Сменить пару сравнения