Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs Qwen: Qwen3 Coder Next

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-29

Метрика GPT-5.4 Nano GPT-5.4 Nano none Релиз: 2026-03-17 Qwen3 Coder Next Qwen3 Coder Next none Релиз: 2026-02-03
Оценка 4.5 5.1
Ранг #128 #113
Надежность Н/Д Н/Д
Стабильность 7.1 9.7
Тестов верно
Доля успешных попыток 31.5% 25.9%
Нестабильные тесты 7 1
Всего запусков 54 54
Стоимость за результат 0.448 0.188
Общая стоимость $0.009 $0.008
???? ????? $0.200 / 1M $0.140 / 1M
???? ?????? $1.250 / 1M $0.800 / 1M
Выходные токены 2,762 3,617
Токены рассуждений 0 0
Время ответа (среднее) 1.40s 10.18s
Время ответа (макс.) 3.84s 45.14s
Время ответа (суммарно) 25.14s 122.13s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 3.5 8.0 16.7% 1 1.18s 800 0
Qwen3 Coder Next 3.6 10.0 0.0% 0 3.31s 1,321 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 7.1 3.7 66.7% 1 1.43s 577 0
Qwen3 Coder Next 7.3 3.7 66.7% 1 3.14s 585 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 3.0 10.0 0.0% 0 3.84s 280 0
Qwen3 Coder Next 3.0 10.0 0.0% 0 45.14s 317 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 6.5 10.0 50.0% 0 1.11s 219 0
Qwen3 Coder Next 6.5 10.0 50.0% 0 1.32s 246 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 2.9 4.4 22.2% 2 926ms 52 0
Qwen3 Coder Next 5.3 10.0 33.3% 0 962ms 26 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 3.8 2.5 33.3% 1 1.31s 180 0
Qwen3 Coder Next 10.0 10.0 100.0% 0 1.34s 152 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 5.0 6.8 33.3% 1 787ms 84 0
Qwen3 Coder Next 4.8 10.0 0.0% 0 7.71s 63 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 3.7 7.3 22.2% 1 1.29s 348 0
Qwen3 Coder Next 3.2 10.0 0.0% 0 22.86s 652 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 10.0 10.0 100.0% 0 3.40s 222 0
Qwen3 Coder Next 10.0 10.0 100.0% 0 2.47s 255 0

Быстрое сравнение

Сменить пару сравнения