Навигация
AI BENCHY
Advertise here

Trinity Large Preview vs Qwen: Qwen3.5-9B

Trinity Large Preview лидирует по среднему баллу: 4.8 vs 3.8. Trinity Large Preview имеет более низкую стоимость benchmark: $0.008 vs $0.036. Trinity Large Preview быстрее: 2.98s vs 82.24s, с долей успешных попыток 21.2% vs 25.8%.

Рекомендуемая модельTrinity Large PreviewЗдесь у него лучший балл (4.8), при этом он примерно в 4.6 раза дешевле, чем Qwen3.5-9B (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-22

Метрика Trinity Large Preview Trinity Large Preview none Релиз: 2026-01-27 Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02
Оценка 4.8 3.8
Ранг #192 #214
Надежность 10.0 5.0
Стабильность 8.9 8.1
Тестов верно
Доля успешных попыток 21.2% 25.8%
Нестабильные тесты 2 5
Всего запусков 63 66
Стоимость за результат 0.017 1.187
Общая стоимость $0.008 $0.036
Цена входа $0.243 / 1M $0.100 / 1M
Цена выхода $0.243 / 1M $0.150 / 1M
Общее число входных токенов 29,828 17,070
Выходные токены 2,169 29,045
Токены рассуждений 0 209,516
Время ответа (среднее) 2.98s 82.24s
Время ответа (макс.) 14.34s 226.38s
Время ответа (суммарно) 56.57s 1315.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#192 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
Стоимость
$0.000
Время
0.0s
Токены
0 tok

#214 Qwen3.5-9B

medium
Стоимость
$0.001
Время
35.9s
Токены
3,030 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

Быстрое сравнение

Сменить пару сравнения