Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.5-27B

Сводка

Сравнение benchmark GPT-5.4 Mini vs Qwen3.5-27B: GPT-5.4 Mini лидирует по среднему баллу: 8.0 vs 7.9. GPT-5.4 Mini имеет более низкую стоимость benchmark: $0.526 vs $0.536. GPT-5.4 Mini быстрее: 22.34s vs 68.39s, с долей успешных попыток 73.0% vs 73.0%.

Рекомендуемая модель: GPT-5.4 Mini - Здесь у него лучший балл (8.0), и он отвечает примерно в 3.1 раза быстрее, чем Qwen3.5-27B.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-17

Метрика GPT-5.4 Mini GPT-5.4 Mini medium Релиз: 2026-03-17 Qwen3.5-27B Qwen3.5-27B medium Релиз: 2026-02-24
Оценка 8.0 7.9
Ранг #27 #29
Надежность 10.0 10.0
Стабильность 8.0 8.5
Тестов верно
Доля успешных попыток 73.0% 73.0%
Нестабильные тесты 5 4
Всего запусков 63 63
Стоимость за результат 4.381 4.901
Общая стоимость $0.526 $0.536
Цена входа $0.750 / 1M $0.195 / 1M
Цена выхода $4.500 / 1M $1.560 / 1M
Общее число входных токенов 34,116 42,164
Выходные токены 2,181 8,534
Токены рассуждений 108,937 329,289
Время ответа (среднее) 22.34s 68.39s
Время ответа (макс.) 138.75s 234.36s
Время ответа (суммарно) 469.20s 1436.24s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#27 GPT-5.4 Mini

medium
Cost
$0.056
Time
95.5s
Tokens
12,464 tok

#29 Qwen3.5-27B

medium
Cost
$0.008
Time
62.0s
Tokens
3,099 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 606 296 2,876
Qwen3.5-27B 8.7 7.9 91.7% 1 19.75s 672 569 31,505
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 11,019 317 4,317
Qwen3.5-27B 10.0 10.0 100.0% 0 163.96s 14,946 483 9,991
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 7,140 234 650
Qwen3.5-27B 10.0 10.0 100.0% 0 30.26s 7,782 270 16,150
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 619 60 43,286
Qwen3.5-27B 5.3 10.0 33.3% 0 79.53s 553 43 52,368
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 477 150 510
Qwen3.5-27B 6.1 3.1 66.7% 1 101.41s 524 70 23,147
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 9.8 10.0 100.0% 0 2.13s 660 96 1,185
Qwen3.5-27B 10.0 10.0 100.0% 0 19.66s 699 97 11,638
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 7.8 10.0 66.7% 0 4.37s 642 278 2,443
Qwen3.5-27B 8.2 7.7 77.8% 1 59.60s 696 242 70,096
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 5,453 251 2,594
Qwen3.5-27B 10.0 10.0 100.0% 0 7.45s 8,193 348 1,323
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.4 Mini 3.0 10.0 0.0% 0 30.10s 195 32 10,174
Qwen3.5-27B 3.0 10.0 0.0% 0 85.11s 204 31 23,683

Быстрое сравнение

Сменить пару сравнения