Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna vs Laguna XS 2.1

GPT-5.6 Luna лидирует по среднему баллу: 5.4 vs 5.3. Laguna XS 2.1 имеет более низкую стоимость benchmark: $0.008 vs $0.029. GPT-5.6 Luna быстрее: 1.50s vs 1.55s, с долей успешных попыток 36.4% vs 30.3%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-20

Ранг
#221
Общее число выходных токенов
6,709
Время ответа (среднее)
1.50s
Общая стоимость
$0.029
Ранг
#227
Общее число выходных токенов
13,377
Время ответа (среднее)
1.55s
Общая стоимость
$0.008
Рекомендуемая модель Laguna XS 2.1

Его балл близок к лучшему здесь (5.3 против 5.4), при этом он примерно в 4.0 раза дешевле, чем GPT-5.6 Luna.

Подробное сравнение

Метрика GPT-5.6 Luna GPT-5.6 Luna none Релиз: 2026-07-09 Laguna XS 2.1 Laguna XS 2.1 none Релиз: 2026-07-02 Бесплатно доступно
Оценка 5.4 5.3
Ранг #221 #227
Надежность 10.0 10.0
Стабильность 8.8 9.0
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 36.4% 30.3%
Нестабильные тесты 3 3
Всего запусков 66 66
Стоимость за результат 2.357 0.143
Общая стоимость $0.029 $0.008
Цена входа $0.200 / 1M $0.060 / 1M
Цена выхода $1.200 / 1M $0.120 / 1M
Общее число входных токенов 101,332 91,607
Выходные токены 6,709 13,377
Токены рассуждений 0 0
Время ответа (среднее) 1.50s 1.55s
Время ответа (макс.) 10.57s 19.02s
Время ответа (суммарно) 33.05s 34.01s
Параметры ~400B всего (~17B активных) 33B всего (3B активных)
Доступность Закрытая модель Веса доступны

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#221 GPT-5.6 Luna

none
Стоимость
$0.016
Время
15.8s
Токены
2,685 tok

#227 Laguna XS 2.1

none
Стоимость
$0.001
Время
27.6s
Токены
4,344 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna XS 2.1 4.3 7.8 22.2% 1 623ms 7,995 562 0

Быстрое сравнение

Сменить пару сравнения