Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Trinity Large Preview vs Elephant

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-14

Метрика Trinity Large Preview Trinity Large Preview none Релиз: 2026-01-27 Бесплатно доступно Elephant Elephant medium Релиз: 2026-04-14
Оценка 5.3 5.2
Ранг #74 #77
Стабильность 9.6 9.6
Тестов верно
Доля успешных попыток 29.6% 29.6%
Нестабильные тесты 1 1
Всего запусков 52 54
Стоимость за результат 0.000 0.000
Общая стоимость $0.000 $0.000
???? ????? $0.000 / 1M $0.000 / 1M
???? ?????? $0.000 / 1M $0.000 / 1M
Выходные токены 1,985 2,596
Токены рассуждений 0 0
Время ответа (среднее) 5.07s 1.27s
Время ответа (макс.) 39.47s 3.70s
Время ответа (суммарно) 91.23s 22.82s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Trinity Large Preview 3.0 10.0 0.0% 0 3.02s 593 0
Elephant 6.6 10.0 50.0% 0 1.19s 815 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Trinity Large Preview 6.3 10.0 0.0% 0 39.47s 142 0
Elephant 5.1 3.3 33.3% 1 1.30s 365 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 294 0
Elephant 3.0 10.0 0.0% 0 3.70s 562 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 186 0
Elephant 6.5 10.0 50.0% 0 979ms 246 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 25 0
Elephant 3.0 10.0 0.0% 0 925ms 24 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Trinity Large Preview 4.4 9.9 0.0% 0 2.86s 124 0
Elephant 4.3 10.0 0.0% 0 920ms 105 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Trinity Large Preview 4.1 6.7 16.7% 1 1.09s 63 0
Elephant 9.8 10.0 100.0% 0 987ms 82 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Trinity Large Preview 5.4 10.0 33.3% 0 3.30s 291 0
Elephant 3.7 10.0 0.0% 0 867ms 166 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 267 0
Elephant 3.0 10.0 0.0% 0 2.83s 231 0

Быстрое сравнение

Сменить пару сравнения