Навигация
Advertise here

Trinity Large Thinking (low) vs DeepSeek V3.2 (medium)

Средний балл практически равен: 6.3 vs 6.3. DeepSeek V3.2 (medium) имеет более низкую стоимость benchmark: $0.145 vs $0.700. DeepSeek V3.2 (medium) быстрее: 70.08s vs 95.16s, с долей успешных попыток 47.8% vs 62.3%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#222
Общее число выходных токенов
842,200
Время ответа (среднее)
95.16s
Общая стоимость
$0.700
Ранг
#221
Общее число выходных токенов
143,160
Время ответа (среднее)
70.08s
Общая стоимость
$0.145
Рекомендуемая модель DeepSeek V3.2 (medium)

Здесь у него лучший балл (6.3), при этом он примерно в 4.8 раза дешевле, чем Trinity Large Thinking (low).

Подробное сравнение

Метрика Trinity Large Thinking Trinity Large Thinking low Релиз: 2026-07-28 DeepSeek V3.2 DeepSeek V3.2 medium Релиз: 2025-12-01
Оценка 6.3 6.3
Ранг #222 #221
Надежность 10.0 10.0
Стабильность 8.1 7.5
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 47.8% 62.3%
Нестабильные тесты 6 7
Всего запусков 69 69
Стоимость за результат 9.163 1.250
Общая стоимость $0.700 $0.145
Цена входа $0.250 / 1M $0.280 / 1M
Цена выхода $0.800 / 1M $0.420 / 1M
Общее число входных токенов 347,980 306,662
Выходные токены 121,898 17,819
Токены рассуждений 720,302 125,341
Время ответа (среднее) 95.16s 70.08s
Время ответа (макс.) 540.96s 376.10s
Время ответа (суммарно) 2188.74s 1611.86s
Параметры 398B всего (13B активных) 671B всего (37B активных)
Доступность Веса доступны Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#222 Trinity Large Thinking

low
Стоимость
$0.021
Время
173.2s
Токены
24,586 tok

#221 DeepSeek V3.2

medium
Стоимость
$0.001
Время
53.6s
Токены
1,932 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014

Быстрое сравнение

Сменить пару сравнения