AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs Qwen: Qwen3.5-35B-A3B

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-17

Метрика	GPT-5.4 Nano GPT-5.4 Nano medium Релиз: 2026-03-17	Qwen3.5-35B-A3B Qwen3.5-35B-A3B none Релиз: 2026-02-24

Метрика	GPT-5.4 Nano GPT-5.4 Nano medium Релиз: 2026-03-17	Qwen3.5-35B-A3B Qwen3.5-35B-A3B none Релиз: 2026-02-24
Ранг	#28	#49
Оценка	7.4	5.9
Стабильность	9.0	8.6
Стоимость за результат	0.769	0.237
Общая стоимость	$0.077	$0.015
Тестов верно
Доля успешных попыток	66.7%	47.1%
Нестабильные тесты	2	3
Всего запусков	51	51
Выходные токены	2,474	3,761
Токены рассуждений	54,516	0
Время ответа (среднее)	11.08s	3.89s
Время ответа (макс.)	94.06s	47.43s
Время ответа (суммарно)	188.39s	66.07s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	8.3	10.0	75.0%	0		4.52s	683	2,254
Qwen3.5-35B-A3B	3.4	7.9	16.7%	1		1.43s	574	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	9.8	10.0	100.0%	0		24.13s	349	5,719
Qwen3.5-35B-A3B	3.0	10.0	0.0%	0		47.43s	1,833	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	10.0	10.0	100.0%	0		2.54s	234	516
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		1.16s	243	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	5.9	7.2	55.6%	1		38.18s	60	43,325
Qwen3.5-35B-A3B	7.7	10.0	66.7%	0		485ms	15	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	4.5	10.0	0.0%	0		4.15s	179	443
Qwen3.5-35B-A3B	6.5	3.4	66.7%	1		1.19s	114	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	9.8	10.0	100.0%	0		1.88s	95	521
Qwen3.5-35B-A3B	6.3	10.0	50.0%	0		809ms	63	0

Puzzle Solving	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	4.0	7.1	22.2%	1		3.65s	640	1,356
Qwen3.5-35B-A3B	3.9	7.4	22.2%	1		1.34s	655	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4 Nano	10.0	10.0	100.0%	0		7.71s	234	382
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		2.30s	264	0

Быстрое сравнение

Сменить пару сравнения

MiniMax M2.5mediumБесплатно доступноvsQwen3.5-35B-A3Bnone gpt-oss-120bmediumБесплатно доступноvsQwen3.5-35B-A3Bnone Claude Sonnet 4.6nonevsGPT-5.4 Nanomedium Mistral Small 4mediumvsQwen3.5-35B-A3Bnone Qwen3.5-35B-A3BnonevsGrok 4.20 Multi-Agent Betamedium GPT-5 NanomediumvsQwen3.5-35B-A3Bnone Gemini 3.1 Flash Lite PreviewnonevsGPT-5.4 Nanomedium Mercury 2mediumvsQwen3.5-35B-A3Bnone Gemini 3 Flash PreviewnonevsGPT-5.4 Nanomedium Gemini 3.1 Flash Lite PreviewlowvsGPT-5.4 Nanomedium GPT-5.4 NanomediumvsQwen3.5 Plus 2026-02-15none GPT-5.4 NanomediumvsGLM 5none