Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (high) vs Qwen3.5-27B (medium)

GPT-5.6 Luna (high) лидирует по среднему баллу: 7.6 vs 7.5. GPT-5.6 Luna (high) имеет более низкую стоимость benchmark: $0.179 vs $0.982. GPT-5.6 Luna (high) быстрее: 16.49s vs 113.28s, с долей успешных попыток 69.7% vs 75.8%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-20

Ранг
#78
Общее число выходных токенов
135,315
Время ответа (среднее)
16.49s
Общая стоимость
$0.179
Ранг
#87
Общее число выходных токенов
614,909
Время ответа (среднее)
113.28s
Общая стоимость
$0.982
Рекомендуемая модель GPT-5.6 Luna (high)

Здесь у него лучший балл (7.6), при этом он примерно в 5.5 раза дешевле, чем Qwen3.5-27B (medium).

Подробное сравнение

Метрика GPT-5.6 Luna GPT-5.6 Luna high Релиз: 2026-07-09 Qwen3.5-27B Qwen3.5-27B medium Релиз: 2026-02-24
Оценка 7.6 7.5
Ранг #78 #87
Надежность 10.0 10.0
Стабильность 8.5 7.8
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 69.7% 75.8%
Нестабильные тесты 4 6
Всего запусков 66 66
Стоимость за результат 6.100 8.217
Общая стоимость $0.179 $0.982
Цена входа $0.200 / 1M $0.195 / 1M
Цена выхода $1.200 / 1M $1.560 / 1M
Общее число входных токенов 80,927 111,644
Выходные токены 5,088 16,113
Токены рассуждений 130,227 598,796
Время ответа (среднее) 16.49s 113.28s
Время ответа (макс.) 111.09s 1026.43s
Время ответа (суммарно) 362.78s 2492.26s
Параметры ~400B всего (~17B активных) 27B
Доступность Закрытая модель Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 GPT-5.6 Luna

high
Стоимость
$0.033
Время
34.2s
Токены
5,484 tok

#87 Qwen3.5-27B

medium
Стоимость
$0.008
Время
62.0s
Токены
3,099 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

Быстрое сравнение

Сменить пару сравнения