- Ранг
- #381
- Общее число выходных токенов
- 96
- Время ответа (среднее)
- 498ms
- Общая стоимость
- $0.002
Tev1 4B Experimental vs Grok 4.20
Grok 4.20 лидирует по среднему баллу: 3.4 vs 1.0. Tev1 4B Experimental имеет более низкую стоимость benchmark: $0.002 vs $0.057. Tev1 4B Experimental быстрее: 498ms vs 1.11s, с долей успешных попыток 13.0% vs 26.1%.
Сравниваемые модели
- Ранг
- #362
- Общее число выходных токенов
- 1,923
- Время ответа (среднее)
- 1.11s
- Общая стоимость
- $0.057
Рекомендуемая модель
Grok 4.20
У него самый высокий балл в этом сравнении (3.4) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.
Подробное сравнение
| Метрика | Tev1 4B Experimental Tev1 4B Experimental none | Grok 4.20 Grok 4.20 none |
|---|---|---|
| Оценка | 1.0 | 3.4 |
| Ранг | #381 | #362 |
| Надежность | 10.0 | Н/Д |
| Стабильность | 3.0 | 7.8 |
| Попытки | 21/69 | 54/69 |
| Тестов верно | ||
| Доля успешных попыток | 13.0% | 26.1% |
| Нестабильные тесты | 0 | 0 |
| Всего запусков | 21 | 54 |
| Стоимость за результат | 0.048 | 1.570 |
| Общая стоимость | $0.002 | $0.057 |
| Цена входа | $0.042 / 1M | $1.250 / 1M |
| Цена выхода | $0.000 / 1M | $2.500 / 1M |
| Цена чтения из кэша | Н/Д | $0.200 / 1M |
| Цена записи в кэш | Н/Д | Н/Д |
| Общее число входных токенов | 33,864 | 41,313 |
| Выходные токены | 96 | 1,923 |
| Токены рассуждений | 0 | 0 |
| Время ответа (среднее) | 498ms | 1.11s |
| Время ответа (макс.) | 602ms | 6.04s |
| Время ответа (суммарно) | 3.49s | 19.96s |
| Параметры | 4B | ~1T всего (~100B активных) |
| Доступность | Веса доступны | Закрытая модель |
Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#381 Together: Tev1 4B Experimental
none
Для этой модели еще не сгенерирован результат showcase.
- Стоимость
- Н/Д
- Время
- -
- Токены
- 0 tok
#362 xAI: Grok 4.20
none- Стоимость
- $0.004
- Время
- 6.5s
- Токены
- 1,367 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Агентные задачи | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Grok 4.20 | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 2.5 | 2.5 | 25.0% | 0 | 602ms | 507 | 6 | 0 | |
| Grok 4.20 | 4.8 | 10.0 | 25.0% | 0 | 501ms | 1,986 | 267 | 0 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Grok 4.20 | 1.1 | 3.1 | 0.0% | 0 | 1.22s | 1,074 | 312 | 0 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Grok 4.20 | 1.5 | 5.0 | 0.0% | 0 | 6.04s | 17,673 | 282 | 0 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 3.0 | 10.0 | 0.0% | 0 | 509ms | 25,317 | 30 | 0 | |
| Grok 4.20 | 10.0 | 10.0 | 100.0% | 0 | 522ms | 7,749 | 207 | 0 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 6.7 | 6.7 | 66.7% | 0 | 440ms | 1,086 | 12 | 0 | |
| Grok 4.20 | 3.0 | 10.0 | 0.0% | 0 | 687ms | 1,746 | 325 | 0 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Grok 4.20 | 4.8 | 10.0 | 0.0% | 0 | 659ms | 819 | 83 | 0 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 1.5 | 5.0 | 0.0% | 0 | 555ms | 6,411 | 42 | 0 | |
| Grok 4.20 | 6.3 | 10.0 | 50.0% | 0 | 445ms | 1,350 | 60 | 0 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 1.7 | 3.3 | 0.0% | 0 | 432ms | 543 | 6 | 0 | |
| Grok 4.20 | 5.3 | 10.0 | 33.3% | 0 | 473ms | 1,671 | 198 | 0 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Grok 4.20 | 10.0 | 10.0 | 100.0% | 0 | 4.63s | 7,245 | 189 | 0 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Tev1 4B Experimental | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Grok 4.20 | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
Быстрое сравнение
Сменить пару сравнения
Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneQwen3.5-9BmediumvsGrok 4.20noneGemini 3 Flash PreviewhighvsTev1 4B ExperimentalnoneGrok 4.20nonevsGLM 4.7 FlashmediumMiniMax M2.5mediumvsGrok 4.20noneCobuddymediumБесплатно доступноvsGrok 4.20noneNemotron 3.5 LightninglowБесплатно доступноvsGrok 4.20none