#28 xAI: Grok 4.5
medium- Стоимость
- $0.044
- Время
- 59.4s
- Токены
- 7,512 tok
Сводка
Grok 4.5 набирает 8.3 в AI BENCHY и занимает #28. У модели надежность 10.0, доля успешных попыток 78.8%, общая стоимость $1.928 и среднее время ответа 61.71s.
Что делает Grok 4.5 особенной: Она использует необычно много reasoning-токенов, что может объяснять более медленные или дорогие запуски.
8.3
Стабильность
8.9
10.0
Общее число выходных токенов
280,567
Общее число входных токенов
122,146
Цена входа
$2.000 / 1M
Цена выхода
$6.000 / 1M
Нестабильные тесты
3
Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
История запусков
| Проверено | Оценка | Надежность | Тестов верно | Общая стоимость | Сравнить |
|---|---|---|---|---|---|
| 2026-07-16 23:09 Добавлен новый тест | 8.3 | 10.0 | $1.928 | Текущий запуск | |
| 2026-07-08 23:28 Повторный тест | 8.3 | 9.9 | $1.696 | Сравнить | |
| 2026-07-08 21:34 Первый запуск | 8.3 | 9.6 | $1.327 | Сравнить |
Этот запуск использовал другой набор бенчмарков. Учитывайте изменения набора при чтении исторической динамики.
Сравнение запусков
| Запуск | Оценка | Стабильность | Надежность | Тестов верно | Нестабильные тесты | Общее число выходных токенов | Общее число входных токенов | Общая стоимость | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|---|---|
| 2026-07-16 23:09 · Текущий запуск | 8.3 | 8.9 | 10.0 | 16/22 | 3 | 280,567 | 122,146 | $1.928 | 61.71s |
| 2026-07-08 21:34 · Первый запуск | 8.3 | 8.9 | 9.6 | 15/21 | 3 | 203,365 | 53,198 | $1.327 | 63.50s |
| Разница | 0.0 | 0.0 | +0.4 | +1 | 0 | +77202 | +68948 | +$0.602 | -1789ms |
Эти два запуска использовали разные наборы бенчмарков, поэтому различия отражают и изменения модели, и изменения набора.
История цен
Исторические данные о ценах для этой модели из OpenRouter.
| Дата | Цена входа | Цена выхода |
|---|---|---|
| 2026-07-08 21:47 | $2.000 / 1M | $6.000 / 1M |
Выберите первую модель, затем нажмите вторую, чтобы открыть страницу сравнения бок о бок.
| Категория | Оценка | Стабильность | Тестов верно |
|---|---|---|---|
| Анти-ИИ уловки | 10.0 | 10.0 | |
| Программирование | 7.6 | 7.2 | |
| Комбинированный | 10.0 | 10.0 | |
| Парсинг и извлечение данных | 10.0 | 10.0 | |
| Предметно-ориентированное | 2.9 | 7.2 | |
| Общий интеллект | 6.5 | 3.4 | |
| Следование инструкциям | 9.8 | 10.0 | |
| Решение головоломок | 10.0 | 10.0 | |
| Вызов инструментов | 10.0 | 10.0 | |
| Эрудиция | 3.0 | 10.0 |