AI BENCHY Compare

Qwen: Qwen3.5-122B-A10B vs Qwen: Qwen3.5-9B

Сводка

Сравнение benchmark Qwen3.5-122B-A10B vs Qwen3.5-9B: Qwen3.5-122B-A10B лидирует по среднему баллу: 5.3 vs 4.2. Qwen3.5-122B-A10B имеет более низкую стоимость benchmark: $0.020 vs $0.036. Qwen3.5-122B-A10B быстрее: 3.41s vs 82.24s, с долей успешных попыток 31.8% vs 27.0%.

Рекомендуемая модель: Qwen3.5-122B-A10B - Здесь у него лучший балл (5.3), при этом он примерно в 1.8 раза дешевле, чем Qwen3.5-9B.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-10

Метрика	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Релиз: 2026-02-24	Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02

Метрика	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Релиз: 2026-02-24	Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02
Оценка	5.3	4.2
Ранг	#132	#162
Надежность	10.0	6.7
Стабильность	9.6	8.0
Тестов верно
Доля успешных попыток	31.8%	27.0%
Нестабильные тесты	1	5
Всего запусков	63	63
Стоимость за результат	0.393	1.187
Общая стоимость	$0.020	$0.036
Цена входа	$0.260 / 1M	$0.100 / 1M
Цена выхода	$2.080 / 1M	$0.150 / 1M
Общее число входных токенов	47,735	17,070
Выходные токены	3,383	29,045
Токены рассуждений	0	209,516
Время ответа (среднее)	3.41s	82.24s
Время ответа (макс.)	46.00s	226.38s
Время ответа (суммарно)	71.59s	1315.88s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#132 Qwen3.5-122B-A10B

none

Cost: $0.016
Time: 44.5s
Tokens: 6,431 tok

#162 Qwen3.5-9B

medium

Cost: $0.001
Time: 35.9s
Tokens: 3,030 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	696	312	0
Qwen3.5-9B	5.1	5.8	50.0%	2		34.44s	369	2,621	12,411

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	3.7	7.0	22.2%	1		2.77s	7,913	693	0
Qwen3.5-9B	2.9	10.0	0.0%	0		100.88s	2,396	7,890	41,129

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	20,175	1,137	0
Qwen3.5-9B	3.0	10.0	0.0%	0		0ms	0	0	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	7,794	243	0
Qwen3.5-9B	3.6	5.6	33.3%	1		87.31s	4,722	1,383	32,113

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	789	15	0
Qwen3.5-9B	3.6	7.2	22.2%	1		137.75s	295	11,549	48,475

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	522	66	0
Qwen3.5-9B	2.8	1.6	33.3%	1		226.38s	180	0	30,695

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		513ms	711	69	0
Qwen3.5-9B	6.5	10.0	50.0%	0		5.75s	381	491	1,824

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	3.8	10.0	0.0%	0		1.00s	714	575	0
Qwen3.5-9B	3.0	10.0	0.0%	0		32.27s	376	1,593	12,026

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	8,211	264	0
Qwen3.5-9B	10.0	10.0	100.0%	0		4.31s	8,283	444	1,149

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		295ms	210	9	0
Qwen3.5-9B	3.0	10.0	0.0%	0		177.02s	68	3,074	29,694

Быстрое сравнение

Сменить пару сравнения

MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone Mistral Small 4mediumvsQwen3.5-122B-A10Bnone MiniMax M2.5mediumvsQwen3.5-122B-A10Bnone Ling-2.6-1TnonevsQwen3.5-9Bmedium Granite 4.1 8BnonevsQwen3.5-9Bmedium CobuddymediumvsQwen3.5-122B-A10Bnone Mercury 2nonevsQwen3.5-9Bmedium Qwen3.5-9BmediumvsMiMo-V2-Flashnone Trinity Large PreviewnonevsQwen3.5-9Bmedium GPT-5.4 NanononevsQwen3.5-9Bmedium Nemotron 3 SupermediumБесплатно доступноvsQwen3.5-122B-A10Bnone GPT-4o-mininonevsQwen3.5-9Bmedium