Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Owl Alpha vs Qwen: Qwen3.5-122B-A10B

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-30

Метрика Owl Alpha Owl Alpha medium Релиз: 2026-04-30 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Релиз: 2026-02-24
Оценка 5.8 5.9
Ранг #91 #88
Надежность 10.0 Н/Д
Стабильность 9.5 9.5
Тестов верно
Доля успешных попыток 40.7% 42.6%
Нестабильные тесты 1 1
Всего запусков 54 54
Стоимость за результат 0.000 0.308
Общая стоимость $0.000 $0.022
???? ????? $0.000 / 1M $0.260 / 1M
???? ?????? $0.000 / 1M $2.080 / 1M
Выходные токены 1,596 3,341
Токены рассуждений 0 0
Время ответа (среднее) 11.04s 3.69s
Время ответа (макс.) 58.63s 46.00s
Время ответа (суммарно) 198.65s 66.50s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Owl Alpha 4.8 10.0 25.0% 0 3.97s 87 0
Qwen3.5-122B-A10B 4.8 10.0 25.0% 0 1.59s 312 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Owl Alpha 10.0 10.0 100.0% 0 7.35s 402 0
Qwen3.5-122B-A10B 4.3 1.1 66.7% 1 3.44s 659 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Owl Alpha 3.0 10.0 0.0% 0 10.01s 315 0
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 46.00s 1,137 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Owl Alpha 10.0 10.0 100.0% 0 21.64s 246 0
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 1.01s 243 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Owl Alpha 5.3 10.0 33.3% 0 8.58s 28 0
Qwen3.5-122B-A10B 5.3 10.0 33.3% 0 465ms 15 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Owl Alpha 4.3 10.0 0.0% 0 58.63s 98 0
Qwen3.5-122B-A10B 5.0 10.0 0.0% 0 1.12s 66 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Owl Alpha 6.3 10.0 50.0% 0 9.59s 57 0
Qwen3.5-122B-A10B 6.3 10.0 50.0% 0 585ms 70 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Owl Alpha 3.4 7.2 11.1% 1 3.44s 135 0
Qwen3.5-122B-A10B 5.4 10.0 33.3% 0 982ms 575 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Owl Alpha 10.0 10.0 100.0% 0 8.26s 228 0
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 2.04s 264 0

Быстрое сравнение

Сменить пару сравнения