- Ранг
- #222
- Общее число выходных токенов
- 842,200
- Время ответа (среднее)
- 95.16s
- Общая стоимость
- $0.700
Trinity Large Thinking (low) vs KAT-Coder-Pro V2.5 (medium)
Trinity Large Thinking (low) лидирует по среднему баллу: 6.3 vs 6.2. KAT-Coder-Pro V2.5 (medium) имеет более низкую стоимость benchmark: $0.478 vs $0.700. KAT-Coder-Pro V2.5 (medium) быстрее: 23.94s vs 95.16s, с долей успешных попыток 47.8% vs 62.3%.
Сравниваемые модели
- Ранг
- #226
- Общее число выходных токенов
- 139,375
- Время ответа (среднее)
- 23.94s
- Общая стоимость
- $0.478
Рекомендуемая модель
KAT-Coder-Pro V2.5 (medium)
Его балл близок к лучшему здесь (6.2 против 6.3), и он отвечает примерно в 4.0 раза быстрее, чем Trinity Large Thinking (low).
Подробное сравнение
| Метрика | Trinity Large Thinking Trinity Large Thinking low | KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium |
|---|---|---|
| Оценка | 6.3 | 6.2 |
| Ранг | #222 | #226 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 8.1 | 7.2 |
| Попытки | 69/69 | 69/69 |
| Тестов верно | ||
| Доля успешных попыток | 47.8% | 62.3% |
| Нестабильные тесты | 6 | 8 |
| Всего запусков | 69 | 69 |
| Стоимость за результат | 9.163 | 4.342 |
| Общая стоимость | $0.700 | $0.478 |
| Цена входа | $0.250 / 1M | $0.740 / 1M |
| Цена выхода | $0.800 / 1M | $2.960 / 1M |
| Общее число входных токенов | 347,980 | 87,916 |
| Выходные токены | 121,898 | 7,213 |
| Токены рассуждений | 720,302 | 132,162 |
| Время ответа (среднее) | 95.16s | 23.94s |
| Время ответа (макс.) | 540.96s | 257.00s |
| Время ответа (суммарно) | 2188.74s | 550.52s |
| Параметры | 398B всего (13B активных) | ~700B всего (~72B активных) |
| Доступность | Веса доступны | Закрытая модель |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#222 Trinity Large Thinking
low- Стоимость
- $0.021
- Время
- 173.2s
- Токены
- 24,586 tok
#226 KAT-Coder-Pro V2.5
medium- Стоимость
- $0.009
- Время
- 25.6s
- Токены
- 2,939 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Агентные задачи | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.4 | 3.8 | 66.7% | 1 | 63.23s | 225,126 | 2,088 | 21,753 | |
| KAT-Coder-Pro V2.5 | 3.0 | 10.0 | 0.0% | 0 | 3.38s | 0 | 0 | 0 |
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 8.3 | 10.0 | 75.0% | 0 | 5.70s | 663 | 1,451 | 5,431 | |
| KAT-Coder-Pro V2.5 | 8.2 | 7.9 | 83.3% | 1 | 3.90s | 672 | 208 | 3,868 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.3 | 10.0 | 33.3% | 0 | 344.45s | 5,441 | 27,039 | 217,241 | |
| KAT-Coder-Pro V2.5 | 7.8 | 10.0 | 66.7% | 0 | 33.10s | 7,893 | 416 | 33,658 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.2 | 6.0 | 33.3% | 1 | 291.02s | 99,467 | 9,848 | 234,039 | |
| KAT-Coder-Pro V2.5 | 6.4 | 5.8 | 66.7% | 1 | 135.75s | 60,289 | 5,478 | 51,591 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.3 | 5.8 | 83.3% | 1 | 14.30s | 6,906 | 459 | 9,451 | |
| KAT-Coder-Pro V2.5 | 7.3 | 5.9 | 83.3% | 1 | 4.70s | 7,776 | 275 | 2,122 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 7.2 | 11.1% | 1 | 140.26s | 756 | 72,049 | 217,598 | |
| KAT-Coder-Pro V2.5 | 2.9 | 4.4 | 22.2% | 2 | 35.11s | 780 | 36 | 33,495 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 12.65s | 501 | 5,138 | 5,695 | |
| KAT-Coder-Pro V2.5 | 4.7 | 3.1 | 33.3% | 1 | 2.35s | 516 | 92 | 381 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.4 | 6.8 | 16.7% | 1 | 4.07s | 684 | 45 | 3,710 | |
| KAT-Coder-Pro V2.5 | 9.9 | 10.0 | 100.0% | 0 | 2.58s | 699 | 83 | 971 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 7.9 | 44.4% | 1 | 3.28s | 678 | 2,625 | 3,077 | |
| KAT-Coder-Pro V2.5 | 5.9 | 4.5 | 66.7% | 2 | 3.20s | 696 | 325 | 1,867 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.19s | 7,551 | 299 | 1,430 | |
| KAT-Coder-Pro V2.5 | 10.0 | 10.0 | 100.0% | 0 | 19.02s | 8,391 | 282 | 1,010 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 2.10s | 207 | 857 | 877 | |
| KAT-Coder-Pro V2.5 | 3.0 | 10.0 | 0.0% | 0 | 9.87s | 204 | 18 | 3,199 |
Быстрое сравнение
Сменить пару сравнения
Trinity Large ThinkinglowvsDeepSeek V3.2mediumTrinity Large ThinkinglowvsSpace Bunny AlphamediumKAT-Coder-Pro V2.5mediumvsSpace Bunny AlphaxhighDeepSeek V4 Flash 0731nonevsKAT-Coder-Pro V2.5mediumTrinity Large ThinkinglowvsDeepSeek V4 Flash 0423noneTrinity Large ThinkinglowvsGrok 4.20mediumTrinity Large ThinkinglowvsQwen3.5 Plus 2026-02-15noneTrinity Large ThinkinglowvsSolar Pro 4highGemini 3.1 Flash Lite PreviewnonevsKAT-Coder-Pro V2.5mediumDeepSeek V4 Flash 0423nonevsKAT-Coder-Pro V2.5mediumClaude Fable 5.1lowvsKAT-Coder-Pro V2.5mediumTrinity Large ThinkinglowvsSpace Bunny Alphaxhigh