Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Qwen: Qwen3.5-35B-A3B vs xAI: Grok 4.20

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-02

Метрика Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Релиз: 2026-02-24 Grok 4.20 Grok 4.20 medium Релиз: 2026-03-31
Оценка 7.3 7.1
Ранг #37 #40
Стабильность 6.6 8.2
Тестов верно
Доля успешных попыток 78.4% 66.7%
Нестабильные тесты 7 4
Всего запусков 51 51
Стоимость за результат 3.877 7.358
Общая стоимость $0.349 $0.663
???? ????? $0.163 / 1M $2.000 / 1M
???? ?????? $1.300 / 1M $6.000 / 1M
Выходные токены 5,864 1,494
Токены рассуждений 175,683 97,078
Время ответа (среднее) 42.48s 9.50s
Время ответа (макс.) 106.00s 29.87s
Время ответа (суммарно) 722.12s 161.54s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 798 42,652
Grok 4.20 8.2 7.9 83.3% 1 3.36s 280 8,476
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 775 12,485
Grok 4.20 10.0 10.0 100.0% 0 17.40s 232 9,556
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 235 19,493
Grok 4.20 10.0 10.0 100.0% 0 4.17s 180 5,333
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 41 46,368
Grok 4.20 5.3 10.0 33.3% 0 27.03s 375 49,339
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 20 3,753
Grok 4.20 5.8 2.8 66.7% 1 7.09s 47 4,252
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 97 17,361
Grok 4.20 7.3 5.9 83.3% 1 4.42s 40 5,474
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 6.4 4.4 77.8% 2 31.58s 3,589 32,206
Grok 4.20 6.4 7.7 55.6% 1 3.89s 143 8,028
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 309 1,365
Grok 4.20 3.0 10.0 0.0% 0 13.68s 197 6,620

Быстрое сравнение

Сменить пару сравнения