Навигация
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ember-1 (high) vs Grok 4.6 (low)

Grok 4.6 (low) лидирует по среднему баллу: 6.9 vs 6.9. Grok 4.6 (low) имеет более низкую стоимость benchmark: $0.781 vs $2.405. Grok 4.6 (low) быстрее: 16.44s vs 58.14s, с долей успешных попыток 71.0% vs 66.7%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#163
Общее число выходных токенов
121,223
Время ответа (среднее)
58.14s
Общая стоимость
$2.405
Ранг
#159
Общее число выходных токенов
42,315
Время ответа (среднее)
16.44s
Общая стоимость
$0.781
Рекомендуемая модель Grok 4.6 (low)

Здесь у него лучший балл (6.9), при этом он примерно в 3.1 раза дешевле, чем Ember-1 (high).

Подробное сравнение

Метрика Ember-1 Ember-1 high Релиз: 2026-09-28 Grok 4.6 Grok 4.6 low Релиз: 2026-08-12
Оценка 6.9 6.9
Ранг #163 #159
Надежность 8.6 10.0
Стабильность 7.2 9.6
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 71.0% 66.7%
Нестабильные тесты 8 1
Всего запусков 69 69
Стоимость за результат 20.041 5.205
Общая стоимость $2.405 $0.781
Цена входа $3.000 / 1M $2.000 / 1M
Цена выхода $15.000 / 1M $6.000 / 1M
Общее число входных токенов 195,489 263,427
Выходные токены 12,475 6,006
Токены рассуждений 108,748 36,309
Время ответа (среднее) 58.14s 16.44s
Время ответа (макс.) 255.06s 57.97s
Время ответа (суммарно) 1337.19s 378.14s
Параметры ~2.8T всего (~104B активных) ~1.7T всего (~170B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 Ember-1

high
Стоимость
$0.038
Время
55.1s
Токены
2,671 tok

#159 SpaceXAI: Grok 4.6

low
Стоимость
$0.011
Время
26.0s
Токены
1,941 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

Быстрое сравнение

Сменить пару сравнения