- Ранг
- #222
- Общее число выходных токенов
- 842,200
- Время ответа (среднее)
- 95.16s
- Общая стоимость
- $0.700
Trinity Large Thinking (low) vs Grok 4.20 (medium)
Средний балл практически равен: 6.3 vs 6.3. Trinity Large Thinking (low) имеет более низкую стоимость benchmark: $0.700 vs $1.582. Grok 4.20 (medium) быстрее: 36.73s vs 95.16s, с долей успешных попыток 47.8% vs 58.0%.
Сравниваемые модели
- Ранг
- #224
- Общее число выходных токенов
- 302,087
- Время ответа (среднее)
- 36.73s
- Общая стоимость
- $1.582
Рекомендуемая модель
Trinity Large Thinking (low)
Здесь у него лучший балл (6.3), при этом он примерно в 2.3 раза дешевле, чем Grok 4.20 (medium).
Подробное сравнение
| Метрика | Trinity Large Thinking Trinity Large Thinking low | Grok 4.20 Grok 4.20 medium |
|---|---|---|
| Оценка | 6.3 | 6.3 |
| Ранг | #222 | #224 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 8.1 | 8.2 |
| Попытки | 69/69 | 69/69 |
| Тестов верно | ||
| Доля успешных попыток | 47.8% | 58.0% |
| Нестабильные тесты | 6 | 5 |
| Всего запусков | 69 | 69 |
| Стоимость за результат | 9.163 | 14.374 |
| Общая стоимость | $0.700 | $1.582 |
| Цена входа | $0.250 / 1M | $1.250 / 1M |
| Цена выхода | $0.800 / 1M | $2.500 / 1M |
| Общее число входных токенов | 347,980 | 392,127 |
| Выходные токены | 121,898 | 7,754 |
| Токены рассуждений | 720,302 | 294,333 |
| Время ответа (среднее) | 95.16s | 36.73s |
| Время ответа (макс.) | 540.96s | 199.66s |
| Время ответа (суммарно) | 2188.74s | 844.68s |
| Параметры | 398B всего (13B активных) | ~1T всего (~100B активных) |
| Доступность | Веса доступны | Закрытая модель |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#222 Trinity Large Thinking
low- Стоимость
- $0.021
- Время
- 173.2s
- Токены
- 24,586 tok
#224 SpaceXAI: Grok 4.20
medium- Стоимость
- $0.041
- Время
- 110.3s
- Токены
- 16,336 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Агентные задачи | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.4 | 3.8 | 66.7% | 1 | 63.23s | 225,126 | 2,088 | 21,753 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 128.32s | 289,141 | 1,894 | 29,934 |
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 8.3 | 10.0 | 75.0% | 0 | 5.70s | 663 | 1,451 | 5,431 | |
| Grok 4.20 | 8.2 | 7.9 | 83.3% | 1 | 3.95s | 2,010 | 287 | 8,312 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.3 | 10.0 | 33.3% | 0 | 344.45s | 5,441 | 27,039 | 217,241 | |
| Grok 4.20 | 6.3 | 6.6 | 55.6% | 1 | 109.93s | 8,307 | 268 | 103,150 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.2 | 6.0 | 33.3% | 1 | 291.02s | 99,467 | 9,848 | 234,039 | |
| Grok 4.20 | 8.7 | 6.9 | 83.3% | 1 | 42.25s | 71,267 | 3,776 | 44,009 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.3 | 5.8 | 83.3% | 1 | 14.30s | 6,906 | 459 | 9,451 | |
| Grok 4.20 | 10.0 | 10.0 | 100.0% | 0 | 4.17s | 7,761 | 180 | 5,333 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 7.2 | 11.1% | 1 | 140.26s | 756 | 72,049 | 217,598 | |
| Grok 4.20 | 2.9 | 7.2 | 11.1% | 1 | 49.71s | 1,959 | 872 | 59,761 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 12.65s | 501 | 5,138 | 5,695 | |
| Grok 4.20 | 3.9 | 2.6 | 33.3% | 1 | 24.48s | 825 | 65 | 6,440 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.4 | 6.8 | 16.7% | 1 | 4.07s | 684 | 45 | 3,710 | |
| Grok 4.20 | 9.8 | 10.0 | 100.0% | 0 | 4.26s | 1,362 | 57 | 6,419 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 7.9 | 44.4% | 1 | 3.28s | 678 | 2,625 | 3,077 | |
| Grok 4.20 | 7.7 | 10.0 | 66.7% | 0 | 6.22s | 1,689 | 149 | 7,913 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.19s | 7,551 | 299 | 1,430 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 13.68s | 7,275 | 197 | 6,620 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 2.10s | 207 | 857 | 877 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 63.48s | 531 | 9 | 16,442 |
Быстрое сравнение
Сменить пару сравнения
DeepSeek V4 Flash 0423nonevsGrok 4.20mediumTrinity Large ThinkinglowvsDeepSeek V3.2mediumTrinity Large ThinkinglowvsSpace Bunny AlphamediumTrinity Large ThinkinglowvsDeepSeek V4 Flash 0423noneTrinity Large ThinkinglowvsQwen3.5 Plus 2026-02-15noneTrinity Large ThinkinglowvsSolar Pro 4highSpace Bunny AlphaxhighvsGrok 4.20mediumQwen3.5 Plus 2026-02-15nonevsGrok 4.20mediumSolar Pro 4highvsGrok 4.20mediumGemini 3.1 Flash LitelowvsGrok 4.20mediumTrinity Large ThinkinglowvsSpace Bunny AlphaxhighDeepSeek V4 Flash 0731nonevsGrok 4.20medium