Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (low) vs gpt-oss-120b (medium)

Средний балл практически равен: 6.2 vs 6.1. gpt-oss-120b (medium) имеет более низкую стоимость benchmark: $0.019 vs $0.026. GPT-5.6 Luna (low) быстрее: 5.20s vs 20.81s, с долей успешных попыток 54.5% vs 50.0%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-15

Ранг
#165
Общее число выходных токенов
26,286
Время ответа (среднее)
5.20s
Общая стоимость
$0.026
Ранг
#169
Общее число выходных токенов
98,282
Время ответа (среднее)
20.81s
Общая стоимость
$0.019
Рекомендуемая модель GPT-5.6 Luna (low)

Здесь у него лучший балл (6.2), и он отвечает примерно в 4.0 раза быстрее, чем gpt-oss-120b (medium).

Подробное сравнение

Метрика GPT-5.6 Luna GPT-5.6 Luna low Релиз: 2026-07-09 gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05
Оценка 6.2 6.1
Ранг #165 #169
Надежность 10.0 10.0
Стабильность 8.2 8.0
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 54.5% 50.0%
Нестабильные тесты 5 5
Всего запусков 66 66
Стоимость за результат 2.437 0.224
Общая стоимость $0.026 $0.019
Цена входа $0.100 / 1M $0.030 / 1M
Цена выхода $0.600 / 1M $0.170 / 1M
Общее число входных токенов 96,355 108,767
Выходные токены 8,213 29,378
Токены рассуждений 18,073 68,904
Время ответа (среднее) 5.20s 20.81s
Время ответа (макс.) 19.44s 68.16s
Время ответа (суммарно) 114.46s 332.88s
Параметры ~400B всего (~17B активных) 117B всего (5.1B активных)
Доступность Закрытая модель Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#165 GPT-5.6 Luna

low
Стоимость
$0.011
Время
10.2s
Токены
1,897 tok

#169 gpt-oss-120b

medium
Стоимость
$0.001
Время
26.7s
Токены
555 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

Быстрое сравнение

Сменить пару сравнения