Навигация
Advertise here

Trinity Large Thinking (high) vs Mistral Large 4

Средний балл практически равен: 5.7 vs 5.7. Mistral Large 4 имеет более низкую стоимость benchmark: $0.290 vs $0.794. Mistral Large 4 быстрее: 20.43s vs 74.52s, с долей успешных попыток 42.0% vs 31.9%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-07

Сравниваемые модели

Ранг
#269
Общее число выходных токенов
717,762
Время ответа (среднее)
74.52s
Общая стоимость
$0.794
Ранг
#272
Общее число выходных токенов
54,388
Время ответа (среднее)
20.43s
Общая стоимость
$0.290
Рекомендуемая модель Mistral Large 4

Здесь у него лучший балл (5.7), при этом он примерно в 2.7 раза дешевле, чем Trinity Large Thinking (high).

Подробное сравнение

Метрика Trinity Large Thinking Trinity Large Thinking high Релиз: 2026-07-28 Mistral Large 4 Mistral Large 4 none Релиз: 2026-10-06
Оценка 5.7 5.7
Ранг #269 #272
Надежность 10.0 9.7
Стабильность 7.3 9.3
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 42.0% 31.9%
Нестабильные тесты 8 2
Всего запусков 69 69
Стоимость за результат 11.289 4.818
Общая стоимость $0.794 $0.290
Цена входа $0.250 / 1M $0.680 / 1M
Цена выхода $0.800 / 1M $2.090 / 1M
Цена чтения из кэша $0.060 / 1M $0.070 / 1M
Цена записи в кэш Н/Д Н/Д
Общее число входных токенов 283,116 257,872
Выходные токены 277,920 54,388
Токены рассуждений 665,124 0
Время ответа (среднее) 74.52s 20.43s
Время ответа (макс.) 510.21s 192.80s
Время ответа (суммарно) 1713.90s 469.88s
Параметры 398B всего (13B активных) 1.05T всего (49B активных)
Доступность Веса доступны Закрытая модель

Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#269 Trinity Large Thinking

high
Стоимость
$0.028
Время
130.1s
Токены
34,387 tok

#272 Mistral Large 4

none
Стоимость
$0.005
Время
33.0s
Токены
2,461 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Mistral Large 4 4.7 7.5 22.2% 1 85.04s 7,431 39,805 0

Сменить пару сравнения