Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Trinity Large Preview vs Cobuddy

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-03

Метрика Trinity Large Preview Trinity Large Preview none Релиз: 2026-01-27 Cobuddy Cobuddy medium Релиз: 2026-05-06
Оценка 4.7 5.8
Ранг #148 #116
Надежность 10.0 10.0
Стабильность 9.3 7.4
Тестов верно
Доля успешных попыток 23.3% 50.0%
Нестабильные тесты 2 6
Всего запусков 60 60
Стоимость за результат 0.017 0.000
Общая стоимость $0.008 $0.000
Цена входа $0.243 / 1M $0.000 / 1M
Цена выхода $0.243 / 1M $0.000 / 1M
Общее число входных токенов 29,828 37,449
Выходные токены 2,169 1,677
Токены рассуждений 0 116,703
Время ответа (среднее) 2.98s 39.90s
Время ответа (макс.) 14.34s 309.02s
Время ответа (суммарно) 56.57s 797.98s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 3.1 10.0 0.0% 0 2.07s 651 550 0
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 4.0 6.6 16.7% 1 14.34s 738 397 0
Cobuddy 4.1 5.1 33.3% 1 79.17s 4,726 358 30,138
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 12,053 294 0
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 6,900 186 0
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 738 25 0
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 4.5 10.0 0.0% 0 873ms 498 104 0
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 3.5 10.0 0.0% 0 822ms 678 63 0
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 3.6 7.7 11.1% 1 1.97s 669 265 0
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 6,699 267 0
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Trinity Large Preview 3.0 10.0 0.0% 0 777ms 204 18 0
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863

Быстрое сравнение

Сменить пару сравнения