Навигация
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs GPT-5.4 Mini

Средний балл практически равен: 5.7 vs 5.7. GPT-5.4 Mini имеет более низкую стоимость benchmark: $0.170 vs $0.645. GPT-5.4 Mini быстрее: 3.34s vs 74.52s, с долей успешных попыток 42.0% vs 30.4%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#253
Общее число выходных токенов
943,044
Время ответа (среднее)
74.52s
Общая стоимость
$0.645
Ранг
#255
Общее число выходных токенов
8,828
Время ответа (среднее)
3.34s
Общая стоимость
$0.170
Рекомендуемая модель GPT-5.4 Mini

Здесь у него лучший балл (5.7), при этом он примерно в 3.8 раза дешевле, чем Trinity Large Thinking (high).

Подробное сравнение

Метрика Trinity Large Thinking Trinity Large Thinking high Релиз: 2026-07-28 GPT-5.4 Mini GPT-5.4 Mini none Релиз: 2026-03-17
Оценка 5.7 5.7
Ранг #253 #255
Надежность 10.0 10.0
Стабильность 7.3 9.3
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 42.0% 30.4%
Нестабильные тесты 8 2
Всего запусков 69 69
Стоимость за результат 11.289 2.818
Общая стоимость $0.645 $0.170
Цена входа $0.250 / 1M $0.750 / 1M
Цена выхода $0.800 / 1M $4.500 / 1M
Общее число входных токенов 283,116 172,438
Выходные токены 277,920 8,828
Токены рассуждений 665,124 0
Время ответа (среднее) 74.52s 3.34s
Время ответа (макс.) 510.21s 41.98s
Время ответа (суммарно) 1713.90s 76.84s
Параметры 398B всего (13B активных) ~400B всего (~17B активных)
Доступность Веса доступны Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#253 Trinity Large Thinking

high
Стоимость
$0.028
Время
130.1s
Токены
34,387 tok

#255 GPT-5.4 Mini

none
Стоимость
$0.010
Время
11.7s
Токены
2,151 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

Быстрое сравнение

Сменить пару сравнения