Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (medium) vs gpt-oss-120b (medium)

Средний балл практически равен: 6.1 vs 6.1. gpt-oss-120b (medium) имеет более низкую стоимость benchmark: $0.019 vs $0.798. gpt-oss-120b (medium) быстрее: 20.81s vs 85.44s, с долей успешных попыток 48.5% vs 50.0%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-15

Ранг
#174
Общее число выходных токенов
1,016,785
Время ответа (среднее)
85.44s
Общая стоимость
$0.798
Ранг
#169
Общее число выходных токенов
98,282
Время ответа (среднее)
20.81s
Общая стоимость
$0.019
Рекомендуемая модель gpt-oss-120b (medium)

Здесь у него лучший балл (6.1), при этом он примерно в 43.7 раза дешевле, чем Trinity Large Thinking (medium).

Подробное сравнение

Метрика Trinity Large Thinking Trinity Large Thinking medium Релиз: 2026-07-28 gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05
Оценка 6.1 6.1
Ранг #174 #169
Надежность 10.0 10.0
Стабильность 7.9 8.0
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 48.5% 50.0%
Нестабильные тесты 6 5
Всего запусков 66 66
Стоимость за результат 9.972 0.224
Общая стоимость $0.798 $0.019
Цена входа $0.220 / 1M $0.030 / 1M
Цена выхода $0.850 / 1M $0.170 / 1M
Общее число входных токенов 118,486 108,767
Выходные токены 156,166 29,378
Токены рассуждений 860,619 68,904
Время ответа (среднее) 85.44s 20.81s
Время ответа (макс.) 525.14s 68.16s
Время ответа (суммарно) 1879.75s 332.88s
Параметры 398B всего (13B активных) 117B всего (5.1B активных)
Доступность Веса доступны Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#174 Trinity Large Thinking

medium
Стоимость
$0.016
Время
75.9s
Токены
19,401 tok

#169 gpt-oss-120b

medium
Стоимость
$0.001
Время
26.7s
Токены
555 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

Быстрое сравнение

Сменить пару сравнения