Навигация
Advertise here

GPT-5.6 Luna (medium) vs Grok 4.20 (medium)

GPT-5.6 Luna (medium) лидирует по среднему баллу: 7.4 vs 6.3. GPT-5.6 Luna (medium) имеет более низкую стоимость benchmark: $0.065 vs $1.246. GPT-5.6 Luna (medium) быстрее: 9.64s vs 36.73s, с долей успешных попыток 62.3% vs 58.0%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#122
Общее число выходных токенов
47,986
Время ответа (среднее)
9.64s
Общая стоимость
$0.065
Ранг
#224
Общее число выходных токенов
302,087
Время ответа (среднее)
36.73s
Общая стоимость
$1.246
Рекомендуемая модель GPT-5.6 Luna (medium)

Здесь у него лучший балл (7.4), при этом он примерно в 19.3 раза дешевле, чем Grok 4.20 (medium).

Подробное сравнение

Метрика GPT-5.6 Luna GPT-5.6 Luna medium Релиз: 2026-07-09 Grok 4.20 Grok 4.20 medium Релиз: 2026-03-31
Оценка 7.4 6.3
Ранг #122 #224
Надежность 10.0 10.0
Стабильность 9.0 8.2
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 62.3% 58.0%
Нестабильные тесты 3 5
Всего запусков 69 69
Стоимость за результат 2.822 14.374
Общая стоимость $0.065 $1.246
Цена входа $0.200 / 1M $1.250 / 1M
Цена выхода $1.200 / 1M $2.500 / 1M
Цена чтения из кэша $0.020 / 1M $0.200 / 1M
Цена записи в кэш $0.250 / 1M Н/Д
Общее число входных токенов 212,780 392,127
Выходные токены 6,849 7,754
Токены рассуждений 41,137 294,333
Время ответа (среднее) 9.64s 36.73s
Время ответа (макс.) 58.09s 199.66s
Время ответа (суммарно) 221.62s 844.68s
Параметры ~400B всего (~17B активных) ~1T всего (~100B активных)
Доступность Закрытая модель Закрытая модель

Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
Стоимость
$0.014
Время
14.6s
Токены
2,362 tok

#224 SpaceXAI: Grok 4.20

medium
Стоимость
$0.041
Время
110.3s
Токены
16,336 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

Быстрое сравнение

Сменить пару сравнения