Навигация
AI BENCHY
Advertise here

GPT-5.6 Luna (low) vs Qwen3.5-Flash (medium)

GPT-5.6 Luna (low) лидирует по среднему баллу: 6.2 vs 6.1. GPT-5.6 Luna (low) имеет более низкую стоимость benchmark: $0.051 vs $0.142. GPT-5.6 Luna (low) быстрее: 5.20s vs 84.44s, с долей успешных попыток 54.5% vs 65.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-29

Ранг
#169
Общее число выходных токенов
26,286
Время ответа (среднее)
5.20s
Общая стоимость
$0.051
Ранг
#176
Общее число выходных токенов
512,846
Время ответа (среднее)
84.44s
Общая стоимость
$0.142
Рекомендуемая модель GPT-5.6 Luna (low)

Здесь у него лучший балл (6.2), при этом он примерно в 2.8 раза дешевле, чем Qwen3.5-Flash (medium).

Подробное сравнение

Метрика GPT-5.6 Luna GPT-5.6 Luna low Релиз: 2026-07-09 Qwen3.5-Flash Qwen3.5-Flash medium Релиз: 2026-02-24
Оценка 6.2 6.1
Ранг #169 #176
Надежность 10.0 10.0
Стабильность 8.2 7.8
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 54.5% 65.2%
Нестабильные тесты 5 6
Всего запусков 66 66
Стоимость за результат 2.437 1.491
Общая стоимость $0.051 $0.142
Цена входа $0.200 / 1M $0.065 / 1M
Цена выхода $1.200 / 1M $0.260 / 1M
Общее число входных токенов 96,355 118,508
Выходные токены 8,213 35,457
Токены рассуждений 18,073 477,389
Время ответа (среднее) 5.20s 84.44s
Время ответа (макс.) 19.44s 515.38s
Время ответа (суммарно) 114.46s 1773.20s
Параметры ~400B всего (~17B активных) ~35B всего (~3B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#169 GPT-5.6 Luna

low
Стоимость
$0.011
Время
10.2s
Токены
1,897 tok

#176 Qwen3.5-Flash

medium
Стоимость
$0.002
Время
25.8s
Токены
4,294 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
Qwen3.5-Flash 3.7 7.2 22.2% 1 58.87s 6,685 302 90,081

Быстрое сравнение

Сменить пару сравнения