- Ранг
- #158
- Общее число выходных токенов
- 110,125
- Время ответа (среднее)
- 56.77s
- Общая стоимость
- $1.798
Ember-1 (high) vs Grok 4.20 (medium)
Ember-1 (high) лидирует по среднему баллу: 7.1 vs 7.0. Grok 4.20 (medium) имеет более низкую стоимость benchmark: $0.805 vs $1.798. Grok 4.20 (medium) быстрее: 32.56s vs 56.77s, с долей успешных попыток 71.2% vs 60.6%.
Сравниваемые модели
- Ранг
- #167
- Общее число выходных токенов
- 270,259
- Время ответа (среднее)
- 32.56s
- Общая стоимость
- $0.805
Рекомендуемая модель
Grok 4.20 (medium)
Его балл близок к лучшему здесь (7.0 против 7.1), при этом он примерно в 2.2 раза дешевле, чем Ember-1 (high).
Подробное сравнение
| Метрика | Ember-1 Ember-1 high | Grok 4.20 Grok 4.20 medium |
|---|---|---|
| Оценка | 7.1 | 7.0 |
| Ранг | #158 | #167 |
| Надежность | 8.0 | 10.0 |
| Стабильность | 7.3 | 8.2 |
| Попытки | 66/66 | 66/66 |
| Тестов верно | ||
| Доля успешных попыток | 71.2% | 60.6% |
| Нестабильные тесты | 7 | 5 |
| Всего запусков | 66 | 66 |
| Стоимость за результат | 14.981 | 10.365 |
| Общая стоимость | $1.798 | $0.805 |
| Цена входа | $3.000 / 1M | $1.250 / 1M |
| Цена выхода | $15.000 / 1M | $2.500 / 1M |
| Общее число входных токенов | 48,577 | 102,986 |
| Выходные токены | 7,345 | 5,860 |
| Токены рассуждений | 102,780 | 264,399 |
| Время ответа (среднее) | 56.77s | 32.56s |
| Время ответа (макс.) | 255.06s | 199.66s |
| Время ответа (суммарно) | 1248.88s | 716.36s |
| Параметры | ~2.8T всего (~104B активных) | ~1T всего (~100B активных) |
| Доступность | Закрытая модель | Закрытая модель |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#158 Ember-1
high- Стоимость
- $0.038
- Время
- 55.1s
- Токены
- 2,671 tok
#167 SpaceXAI: Grok 4.20
medium- Стоимость
- $0.041
- Время
- 110.3s
- Токены
- 16,336 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
Быстрое сравнение
Сменить пару сравнения
GPT-5.5nonevsGrok 4.20mediumEmber-1highvsGrok 4.3mediumSpace Bunny AlphahighvsGrok 4.20mediumEmber-1highvsGPT-5.6 SolnoneEmber-1highvsGPT-6 LunalowDeepSeek V3.2mediumvsEmber-1highGPT-6 LunalowvsGrok 4.20mediumGPT-5.6 SolnonevsGrok 4.20mediumEmber-1highvsGLM 5.1mediumEmber-1highvsGPT-5.5noneEmber-1highvsMercury 2mediumClaude Fable 5.1lowvsGrok 4.20medium