Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs Qwen3.5-9B (medium)

Trinity Large Thinking (high) лидирует по среднему баллу: 4.8 vs 3.8. Qwen3.5-9B (medium) имеет более низкую стоимость benchmark: $0.036 vs $0.632. Trinity Large Thinking (high) быстрее: 77.22s vs 82.24s, с долей успешных попыток 39.4% vs 25.8%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-28

Ранг
#202
Общее число выходных токенов
953,758
Время ответа (среднее)
77.22s
Общая стоимость
$0.632
Ранг
#227
Общее число выходных токенов
238,561
Время ответа (среднее)
82.24s
Общая стоимость
$0.036
Рекомендуемая модель Trinity Large Thinking (high)

У него самый высокий балл в этом сравнении (4.8) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Подробное сравнение

Метрика Trinity Large Thinking Trinity Large Thinking high Релиз: 2026-07-28 Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02
Оценка 4.8 3.8
Ранг #202 #227
Надежность 9.9 5.0
Стабильность 7.2 8.1
Тестов верно
Доля успешных попыток 39.4% 25.8%
Нестабильные тесты 8 5
Всего запусков 66 66
Стоимость за результат 12.640 1.187
Общая стоимость $0.632 $0.036
Цена входа $0.220 / 1M $0.100 / 1M
Цена выхода $0.850 / 1M $0.150 / 1M
Общее число входных токенов 101,767 17,070
Выходные токены 286,218 29,045
Токены рассуждений 667,540 209,516
Время ответа (среднее) 77.22s 82.24s
Время ответа (макс.) 510.21s 226.38s
Время ответа (суммарно) 1698.89s 1315.88s

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
Стоимость
$0.028
Время
130.1s
Токены
34,387 tok

#227 Qwen3.5-9B

medium
Стоимость
$0.001
Время
35.9s
Токены
3,030 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

Быстрое сравнение

Сменить пару сравнения