Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Qwen: Qwen3.5-35B-A3B vs xAI: Grok Build 0.1

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-22

Метрика Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Релиз: 2026-02-24 Grok Build 0.1 Grok Build 0.1 none Релиз: 2026-05-21
Оценка 7.0 6.6
Ранг #70 #82
Надежность 6.7 10.0
Стабильность 7.1 8.0
Тестов верно
Доля успешных попыток 71.7% 60.4%
Нестабильные тесты 7 4
Всего запусков 60 57
Стоимость за результат 5.463 7.805
Общая стоимость $0.547 $0.547
???? ????? $0.139 / 1M $1.000 / 1M
???? ?????? $1.000 / 1M $2.000 / 1M
Выходные токены 31,239 267,275
Токены рассуждений 336,167 0
Время ответа (среднее) 69.43s 28.69s
Время ответа (макс.) 409.98s 138.35s
Время ответа (суммарно) 1388.55s 459.00s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 798 42,652
Grok Build 0.1 8.7 7.9 91.7% 1 6.30s 11,162 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 6.5 10.0 50.0% 0 244.54s 14,456 88,431
Grok Build 0.1 10.0 10.0 100.0% 0 21.41s 16,568 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 775 12,485
Grok Build 0.1 0.0 0.0 0.0% 0 0ms 0 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 235 19,493
Grok Build 0.1 4.7 1.6 66.7% 1 9.33s 6,359 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 41 46,368
Grok Build 0.1 3.6 7.2 22.2% 1 103.71s 179,469 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 20 3,753
Grok Build 0.1 4.3 10.0 0.0% 0 12.47s 6,647 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 97 17,361
Grok Build 0.1 9.8 10.0 100.0% 0 7.36s 8,970 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 6.4 4.4 77.8% 2 31.58s 3,589 32,206
Grok Build 0.1 6.4 7.7 55.6% 1 9.55s 14,982 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 309 1,365
Grok Build 0.1 0.0 0.0 0.0% 0 0ms 0 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 177.35s 10,919 72,053
Grok Build 0.1 3.0 10.0 0.0% 0 36.09s 23,118 0

Быстрое сравнение

Сменить пару сравнения