AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs Qwen: Qwen3.5-35B-A3B

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-16

Метрика	GPT-5.4 Nano GPT-5.4 Nano medium Релиз: 2026-03-17	Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Релиз: 2026-02-24

Метрика	GPT-5.4 Nano GPT-5.4 Nano medium Релиз: 2026-03-17	Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Релиз: 2026-02-24
Оценка	7.6	7.4
Ранг	#37	#42
Стабильность	9.0	6.7
Тестов верно
Доля успешных попыток	68.5%	79.6%
Нестабильные тесты	2	7
Всего запусков	54	54
Стоимость за результат	0.747	3.976
Общая стоимость	$0.083	$0.398
???? ?????	$0.200 / 1M	$0.163 / 1M
???? ??????	$1.250 / 1M	$1.300 / 1M
Выходные токены	2,946	10,137
Токены рассуждений	58,132	208,761
Время ответа (среднее)	11.21s	44.51s
Время ответа (макс.)	94.06s	106.00s
Время ответа (суммарно)	201.80s	801.21s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	8.3	10.0	75.0%	0		4.52s	683	2,254
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		21.13s	798	42,652

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	10.0	10.0	100.0%	0		13.41s	472	3,616
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		79.09s	4,273	33,078

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	9.8	10.0	100.0%	0		24.13s	349	5,719
Qwen3.5-35B-A3B	4.7	1.6	66.7%	1		75.34s	775	12,485

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	10.0	10.0	100.0%	0		2.54s	234	516
Qwen3.5-35B-A3B	7.3	5.9	83.3%	1		59.33s	235	19,493

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	5.9	7.2	55.6%	1		38.18s	60	43,325
Qwen3.5-35B-A3B	4.1	4.4	44.5%	2		88.34s	41	46,368

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	4.5	10.0	0.0%	0		4.15s	179	443
Qwen3.5-35B-A3B	2.8	1.6	33.3%	1		30.30s	20	3,753

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	9.8	10.0	100.0%	0		1.88s	95	521
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		24.45s	97	17,361

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	4.0	7.1	22.2%	1		3.65s	640	1,356
Qwen3.5-35B-A3B	6.4	4.4	77.8%	2		31.58s	3,589	32,206

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	10.0	10.0	100.0%	0		7.71s	234	382
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		4.65s	309	1,365

Быстрое сравнение

Сменить пару сравнения

Claude Sonnet 4.6nonevsQwen3.5-35B-A3Bmedium Claude Sonnet 4.6nonevsGPT-5.4 Nanomedium GPT-5.3 ChatnonevsQwen3.5-35B-A3Bmedium Gemini 3.1 Flash Lite PreviewnonevsGPT-5.4 Nanomedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5-35B-A3Bmedium GPT-5.2 ChatnonevsQwen3.5-35B-A3Bmedium Gemma 4 31BnoneБесплатно доступноvsQwen3.5-35B-A3Bmedium Gemini 3.1 Flash Lite PreviewlowvsGPT-5.4 Nanomedium Gemini 3 Flash PreviewnonevsGPT-5.4 Nanomedium Gemma 4 31BnoneБесплатно доступноvsGPT-5.4 Nanomedium Gemini 3.1 Flash Lite PreviewlowvsQwen3.5-35B-A3Bmedium Gemini 3 Flash PreviewnonevsQwen3.5-35B-A3Bmedium