Навигация
Advertise here

Trinity Large Thinking (low) vs GPT-5 Nano (medium)

Trinity Large Thinking (low) лидирует по среднему баллу: 6.0 vs 6.0. GPT-5 Nano (medium) имеет более низкую стоимость benchmark: $0.118 vs $0.625. GPT-5 Nano (medium) быстрее: 54.20s vs 96.61s, с долей успешных попыток 47.0% vs 54.5%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-10

Сравниваемые модели

Ранг
#208
Общее число выходных токенов
818,359
Время ответа (среднее)
96.61s
Общая стоимость
$0.625
Ранг
#213
Общее число выходных токенов
282,437
Время ответа (среднее)
54.20s
Общая стоимость
$0.118
Рекомендуемая модель GPT-5 Nano (medium)

Его балл близок к лучшему здесь (6.0 против 6.0), при этом он примерно в 5.3 раза дешевле, чем Trinity Large Thinking (low).

Подробное сравнение

Метрика Trinity Large Thinking Trinity Large Thinking low Релиз: 2026-07-28 GPT-5 Nano GPT-5 Nano medium Релиз: 2025-08-07
Оценка 6.0 6.0
Ранг #208 #213
Надежность 10.0 10.0
Стабильность 8.3 6.6
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 47.0% 54.5%
Нестабильные тесты 5 9
Всего запусков 66 66
Стоимость за результат 8.221 1.472
Общая стоимость $0.625 $0.118
Цена входа $0.250 / 1M $0.050 / 1M
Цена выхода $0.800 / 1M $0.400 / 1M
Общее число входных токенов 122,854 94,944
Выходные токены 119,810 12,037
Токены рассуждений 698,549 270,400
Время ответа (среднее) 96.61s 54.20s
Время ответа (макс.) 540.96s 227.89s
Время ответа (суммарно) 2125.51s 867.23s
Параметры 398B всего (13B активных) ~120B всего (~5B активных)
Доступность Веса доступны Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 Trinity Large Thinking

low
Стоимость
$0.021
Время
173.2s
Токены
24,586 tok

#213 GPT-5 Nano

medium
Стоимость
$0.006
Время
108.5s
Токены
13,209 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152

Быстрое сравнение

Сменить пару сравнения