Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna vs Laguna S 2.1 (medium)

Средний балл практически равен: 5.4 vs 5.4. GPT-5.6 Luna имеет более низкую стоимость benchmark: $0.029 vs $0.053. GPT-5.6 Luna быстрее: 1.50s vs 58.42s, с долей успешных попыток 36.4% vs 24.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-04

Ранг
#241
Общее число выходных токенов
6,709
Время ответа (среднее)
1.50s
Общая стоимость
$0.029
Ранг
#239
Общее число выходных токенов
339,595
Время ответа (среднее)
58.42s
Общая стоимость
$0.053
Рекомендуемая модель GPT-5.6 Luna

Здесь у него лучший балл (5.4), при этом он примерно в 1.8 раза дешевле, чем Laguna S 2.1 (medium).

Подробное сравнение

Метрика GPT-5.6 Luna GPT-5.6 Luna none Релиз: 2026-07-09 Laguna S 2.1 Laguna S 2.1 medium Релиз: 2026-07-21 Бесплатно доступно
Оценка 5.4 5.4
Ранг #241 #239
Надежность 10.0 10.0
Стабильность 8.8 8.8
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 36.4% 24.2%
Нестабильные тесты 3 3
Всего запусков 66 66
Стоимость за результат 2.357 1.451
Общая стоимость $0.029 $0.053
Цена входа $0.200 / 1M $0.090 / 1M
Цена выхода $1.200 / 1M $0.180 / 1M
Общее число входных токенов 101,332 86,647
Выходные токены 6,709 97,298
Токены рассуждений 0 242,297
Время ответа (среднее) 1.50s 58.42s
Время ответа (макс.) 10.57s 560.31s
Время ответа (суммарно) 33.05s 1285.26s
Параметры ~400B всего (~17B активных) 118B всего (8B активных)
Доступность Закрытая модель Веса доступны

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#241 GPT-5.6 Luna

none
Стоимость
$0.016
Время
15.8s
Токены
2,685 tok

#239 Laguna S 2.1

medium
Стоимость
$0.001
Время
4.0s
Токены
867 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718

Быстрое сравнение

Сменить пару сравнения