AI BENCHY Compare

Trinity Large Preview vs Qwen: Qwen3.5-122B-A10B

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-03

Метрика	Trinity Large Preview Trinity Large Preview none Релиз: 2026-01-27	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Релиз: 2026-02-24

Метрика	Trinity Large Preview Trinity Large Preview none Релиз: 2026-01-27	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Релиз: 2026-02-24
Оценка	4.7	5.4
Ранг	#148	#131
Надежность	10.0	10.0
Стабильность	9.3	9.5
Тестов верно
Доля успешных попыток	23.3%	33.3%
Нестабильные тесты	2	1
Всего запусков	60	60
Стоимость за результат	0.017	0.380
Общая стоимость	$0.008	$0.019
Цена входа	$0.243 / 1M	$0.260 / 1M
Цена выхода	$0.243 / 1M	$2.080 / 1M
Общее число входных токенов	29,828	44,894
Выходные токены	2,169	3,374
Токены рассуждений	0	0
Время ответа (среднее)	2.98s	3.38s
Время ответа (макс.)	14.34s	46.00s
Время ответа (суммарно)	56.57s	67.55s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	3.1	10.0	0.0%	0		2.07s	651	550	0
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	696	312	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	4.0	6.6	16.7%	1		14.34s	738	397	0
Qwen3.5-122B-A10B	4.0	5.5	33.3%	1		2.14s	5,072	684	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	3.0	10.0	0.0%	0		8.91s	12,053	294	0
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	20,175	1,137	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	10.0	10.0	100.0%	0		3.26s	6,900	186	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	7,794	243	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	5.3	10.0	33.3%	0		877ms	738	25	0
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	789	15	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	4.5	10.0	0.0%	0		873ms	498	104	0
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	522	66	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	3.5	10.0	0.0%	0		822ms	678	63	0
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		513ms	711	69	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	3.6	7.7	11.1%	1		1.97s	669	265	0
Qwen3.5-122B-A10B	3.8	10.0	0.0%	0		1.00s	714	575	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	10.0	10.0	100.0%	0		6.67s	6,699	267	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	8,211	264	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Trinity Large Preview	3.0	10.0	0.0%	0		777ms	204	18	0
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		295ms	210	9	0

Быстрое сравнение

Сменить пару сравнения

Trinity Large PreviewnonevsQwen3 Coder Nextmedium Mistral Small 4mediumvsQwen3.5-122B-A10Bnone MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone Elephant AlphamediumvsQwen3.5-122B-A10Bnone MiniMax M2.5mediumvsQwen3.5-122B-A10Bnone Trinity Large PreviewnonevsGLM 4.7 Flashmedium CobuddymediumvsQwen3.5-122B-A10Bnone Trinity Large PreviewnonevsQwen3.5-9Bmedium Owl AlphamediumvsQwen3.5-122B-A10Bnone Trinity Large PreviewnonevsElephant Alphamedium gpt-oss-120bmediumБесплатно доступноvsQwen3.5-122B-A10Bnone Nemotron 3 SupermediumБесплатно доступноvsQwen3.5-122B-A10Bnone