Навигация
Advertise here

Trinity Large Thinking — low против medium

medium лидирует по среднему баллу: 6.1 vs 6.0. low имеет более низкую стоимость benchmark: $0.625 vs $0.756. medium быстрее: 85.44s vs 96.61s, с долей успешных попыток 47.0% vs 48.5%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-10

Сравниваемые модели

Ранг
#208
Общее число выходных токенов
818,359
Время ответа (среднее)
96.61s
Общая стоимость
$0.625
Ранг
#203
Общее число выходных токенов
1,016,785
Время ответа (среднее)
85.44s
Общая стоимость
$0.756
Рекомендуемая модель low

Он дает лучший общий компромисс: конкурентный балл (6.0), ниже стоимость, чем у Trinity Large Thinking (medium), и сбалансированное время ответа.

Подробное сравнение

Метрика Trinity Large Thinking Trinity Large Thinking low Релиз: 2026-07-28 Trinity Large Thinking Trinity Large Thinking medium Релиз: 2026-07-28
Оценка 6.0 6.1
Ранг #208 #203
Надежность 10.0 10.0
Стабильность 8.3 7.9
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 47.0% 48.5%
Нестабильные тесты 5 6
Всего запусков 66 66
Стоимость за результат 8.221 9.972
Общая стоимость $0.625 $0.756
Цена входа $0.250 / 1M $0.250 / 1M
Цена выхода $0.800 / 1M $0.800 / 1M
Общее число входных токенов 122,854 118,486
Выходные токены 119,810 156,166
Токены рассуждений 698,549 860,619
Время ответа (среднее) 96.61s 85.44s
Время ответа (макс.) 540.96s 525.14s
Время ответа (суммарно) 2125.51s 1879.75s
Параметры 398B всего (13B активных) 398B всего (13B активных)
Доступность Веса доступны Веса доступны

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 Trinity Large Thinking

low
Стоимость
$0.021
Время
173.2s
Токены
24,586 tok

#203 Trinity Large Thinking

medium
Стоимость
$0.016
Время
75.9s
Токены
19,401 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155

Быстрое сравнение

Сменить пару сравнения