AI BENCHY Compare

OpenAI: gpt-oss-120b vs Qwen: Qwen3.5-122B-A10B

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-01

Метрика	gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05 Бесплатно доступно	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Релиз: 2026-02-24

Метрика	gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05 Бесплатно доступно	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Релиз: 2026-02-24
Оценка	5.9	5.4
Ранг	#103	#131
Надежность	10.0	10.0
Стабильность	7.9	9.5
Тестов верно
Доля успешных попыток	50.0%	33.3%
Нестабильные тесты	5	1
Всего запусков	60	60
Стоимость за результат	0.151	0.380
Общая стоимость	$0.012	$0.019
Цена входа	$0.000 / 1M	$0.260 / 1M
Цена выхода	$0.000 / 1M	$2.080 / 1M
Выходные токены	17,495	3,374
Токены рассуждений	46,878	0
Время ответа (среднее)	22.41s	3.38s
Время ответа (макс.)	68.16s	46.00s
Время ответа (суммарно)	291.35s	67.55s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	3,518	2,177
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	312	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	3.9	5.6	33.3%	1		47.24s	847	8,618
Qwen3.5-122B-A10B	4.0	5.5	33.3%	1		2.14s	684	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	694	5,072
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	1,137	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	241	1,114
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	243	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	6,784	20,606
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	15	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	107	387
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	66	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	126	1,799
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		513ms	69	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	5.3	7.2	44.4%	1		21.71s	1,790	2,264
Qwen3.5-122B-A10B	3.8	10.0	0.0%	0		1.00s	575	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	287	1,083
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	264	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
gpt-oss-120b	3.0	10.0	0.0%	0		26.51s	3,101	3,758
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		295ms	9	0

Быстрое сравнение

Сменить пару сравнения

gpt-oss-120bmediumБесплатно доступноvsQwen3.5-Flashnone gpt-oss-120bmediumБесплатно доступноvsGLM 5V Turbonone MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone Elephant AlphamediumvsQwen3.5-122B-A10Bnone Seed-2.0-Litenonevsgpt-oss-120bmediumБесплатно доступно Mistral Small 4mediumvsQwen3.5-122B-A10Bnone gpt-oss-120bmediumБесплатно доступноvsGLM 5.1none MiniMax M2.5mediumvsQwen3.5-122B-A10Bnone DeepSeek V4 Prononevsgpt-oss-120bmediumБесплатно доступно gpt-oss-120bmediumБесплатно доступноvsQwen3.5 Plus 2026-04-20none gpt-oss-120bmediumБесплатно доступноvsQwen3.5-35B-A3Bnone gpt-oss-120bmediumБесплатно доступноvsQwen3.5-27Bnone