Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3 Coder Next

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-17

Метрика GPT-5.4 Mini GPT-5.4 Mini none Релиз: 2026-03-17 Qwen3 Coder Next Qwen3 Coder Next none Релиз: 2026-02-03
Ранг #66 #64
Оценка 4.8 5.0
Стабильность 8.6 10.0
Стоимость за результат 0.737 0.175
Общая стоимость $0.030 $0.007
Тестов верно
Доля успешных попыток 31.4% 23.5%
Нестабильные тесты 3 0
Всего запусков 51 51
Выходные токены 2,085 3,032
Токены рассуждений 0 0
Время ответа (среднее) 1.17s 10.82s
Время ответа (макс.) 2.52s 45.14s
Время ответа (суммарно) 19.82s 118.99s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Mini 3.1 8.1 8.3% 1 929ms 654 0
Qwen3 Coder Next 3.6 10.0 0.0% 0 3.31s 1,321 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.52s 298 0
Qwen3 Coder Next 3.0 10.0 0.0% 0 45.14s 317 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Mini 10.0 10.0 100.0% 0 1.30s 222 0
Qwen3 Coder Next 6.5 10.0 50.0% 0 1.32s 246 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Mini 3.5 4.4 33.3% 2 937ms 88 0
Qwen3 Coder Next 5.3 10.0 33.3% 0 962ms 26 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Mini 4.8 10.0 0.0% 0 1.82s 174 0
Qwen3 Coder Next 10.0 10.0 100.0% 0 1.34s 152 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Mini 6.3 10.0 50.0% 0 728ms 101 0
Qwen3 Coder Next 4.8 10.0 0.0% 0 7.71s 63 0
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Mini 5.4 10.0 33.3% 0 860ms 293 0
Qwen3 Coder Next 3.2 10.0 0.0% 0 22.86s 652 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.32s 255 0
Qwen3 Coder Next 10.0 10.0 100.0% 0 2.47s 255 0

Быстрое сравнение

Сменить пару сравнения