Навигация
Advertise here

Mistral Large 4 (high) vs GPT-6 Luna (low)

GPT-6 Luna (low) лидирует по среднему баллу: 7.6 vs 7.5. GPT-6 Luna (low) имеет более низкую стоимость benchmark: $0.033 vs $1.391. GPT-6 Luna (low) быстрее: 23.23s vs 263.69s, с долей успешных попыток 65.2% vs 63.8%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-06

Сравниваемые модели

Ранг
#126
Общее число выходных токенов
590,306
Время ответа (среднее)
263.69s
Общая стоимость
$1.391
Ранг
#121
Общее число выходных токенов
24,880
Время ответа (среднее)
23.23s
Общая стоимость
$0.033
Рекомендуемая модель GPT-6 Luna (low)

Здесь у него лучший балл (7.6), при этом он примерно в 43.4 раза дешевле, чем Mistral Large 4 (high).

Подробное сравнение

Метрика Mistral Large 4 Mistral Large 4 high Релиз: 2026-10-06 GPT-6 Luna GPT-6 Luna low Релиз: 2026-09-23
Оценка 7.5 7.6
Ранг #126 #121
Надежность 9.0 9.7
Стабильность 7.9 8.5
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 65.2% 63.8%
Нестабильные тесты 6 4
Всего запусков 69 69
Стоимость за результат 11.590 0.267
Общая стоимость $1.391 $0.033
Цена входа $0.680 / 1M $0.100 / 1M
Цена выхода $2.090 / 1M $0.500 / 1M
Цена чтения из кэша $0.070 / 1M $0.010 / 1M
Цена записи в кэш Н/Д $0.125 / 1M
Общее число входных токенов 230,895 195,928
Выходные токены 161,281 5,728
Токены рассуждений 510,655 19,152
Время ответа (среднее) 263.69s 23.23s
Время ответа (макс.) 1727.29s 89.37s
Время ответа (суммарно) 6064.89s 534.22s
Параметры 1.05T всего (49B активных) ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 Mistral Large 4

high
Стоимость
$0.007
Время
53.3s
Токены
3,333 tok

#121 GPT-6 Luna

low
Стоимость
$0.002
Время
19.2s
Токены
2,598 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

Быстрое сравнение

Сменить пару сравнения