Навигация
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs gpt-oss-120b (medium)

gpt-oss-120b (medium) лидирует по среднему баллу: 6.1 vs 6.0. gpt-oss-120b (medium) имеет более низкую стоимость benchmark: $0.019 vs $0.656. gpt-oss-120b (medium) быстрее: 21.91s vs 96.78s, с долей успешных попыток 48.5% vs 50.0%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-28

Ранг
#145
Общее число выходных токенов
815,220
Время ответа (среднее)
96.78s
Общая стоимость
$0.656
Ранг
#135
Общее число выходных токенов
97,816
Время ответа (среднее)
21.91s
Общая стоимость
$0.019
Рекомендуемая модель gpt-oss-120b (medium)

Здесь у него лучший балл (6.1), при этом он примерно в 35.0 раза дешевле, чем Trinity Large Thinking (low).

Подробное сравнение

Метрика Trinity Large Thinking Trinity Large Thinking low Релиз: 2026-07-28 gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05
Оценка 6.0 6.1
Ранг #145 #135
Надежность 9.7 10.0
Стабильность 7.9 8.0
Тестов верно
Доля успешных попыток 48.5% 50.0%
Нестабильные тесты 6 5
Всего запусков 66 66
Стоимость за результат 8.199 0.221
Общая стоимость $0.656 $0.019
Цена входа $0.220 / 1M $0.037 / 1M
Цена выхода $0.850 / 1M $0.170 / 1M
Общее число входных токенов 122,845 108,747
Выходные токены 117,704 29,772
Токены рассуждений 697,516 68,044
Время ответа (среднее) 96.78s 21.91s
Время ответа (макс.) 540.96s 68.16s
Время ответа (суммарно) 2129.13s 328.70s

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
Стоимость
$0.021
Время
173.2s
Токены
24,586 tok

#135 gpt-oss-120b

medium
Стоимость
$0.001
Время
26.7s
Токены
555 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973

Быстрое сравнение

Сменить пару сравнения