Навигация
AI BENCHY
Advertise here

Qwen3.5-122B-A10B (medium) vs Grok 4.3 (medium)

Qwen3.5-122B-A10B (medium) лидирует по среднему баллу: 7.1 vs 7.0. Grok 4.3 (medium) имеет более низкую стоимость benchmark: $0.741 vs $1.047. Grok 4.3 (medium) быстрее: 44.21s vs 65.67s, с долей успешных попыток 71.2% vs 66.7%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-26

Ранг
#113
Общее число выходных токенов
487,519
Время ответа (среднее)
65.67s
Общая стоимость
$1.047
Ранг
#117
Общее число выходных токенов
225,904
Время ответа (среднее)
44.21s
Общая стоимость
$0.741
Рекомендуемая модель Grok 4.3 (medium)

Он дает лучший общий компромисс: конкурентный балл (7.0), ниже стоимость, чем у Qwen3.5-122B-A10B (medium), и сбалансированное время ответа.

Подробное сравнение

Метрика Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Релиз: 2026-02-24 Grok 4.3 Grok 4.3 medium Релиз: 2026-05-01
Оценка 7.1 7.0
Ранг #113 #117
Надежность 10.0 10.0
Стабильность 8.5 8.2
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 71.2% 66.7%
Нестабильные тесты 4 5
Всего запусков 66 66
Стоимость за результат 8.446 6.168
Общая стоимость $1.047 $0.741
Цена входа $0.260 / 1M $1.250 / 1M
Цена выхода $2.080 / 1M $2.500 / 1M
Общее число входных токенов 124,780 140,244
Выходные токены 47,694 13,739
Токены рассуждений 439,825 212,165
Время ответа (среднее) 65.67s 44.21s
Время ответа (макс.) 519.30s 216.69s
Время ответа (суммарно) 1444.68s 972.64s
Параметры 122B всего (10B активных) ~1.5T всего (~150B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#113 Qwen3.5-122B-A10B

medium
Стоимость
$0.019
Время
48.7s
Токены
6,034 tok

#117 SpaceXAI: Grok 4.3

medium
Стоимость
$0.009
Время
19.0s
Токены
3,661 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

Быстрое сравнение

Сменить пару сравнения