Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs xAI: Grok Build 0.1

Средний балл практически равен: 7.5 vs 7.6. Grok Build 0.1 (medium) имеет более низкую стоимость benchmark: $1.097 vs $1.550. Claude Opus 5 быстрее: 7.60s vs 52.06s, с долей успешных попыток 57.6% vs 63.6%.

Рекомендуемая модельClaude Opus 5Здесь у него лучший балл (7.5), и он отвечает примерно в 6.8 раза быстрее, чем Grok Build 0.1 (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика Claude Opus 5 Claude Opus 5 none Релиз: 2026-07-25 Grok Build 0.1 Grok Build 0.1 medium Релиз: 2026-05-21
Оценка 7.5 7.6
Ранг #59 #55
Надежность 10.0 10.0
Стабильность 9.6 10.0
Тестов верно
Доля успешных попыток 57.6% 63.6%
Нестабильные тесты 1 0
Всего запусков 66 66
Стоимость за результат 12.912 7.830
Общая стоимость $1.550 $1.097
Цена входа $5.000 / 1M $1.000 / 1M
Цена выхода $25.000 / 1M $2.000 / 1M
Общее число входных токенов 185,550 106,751
Выходные токены 24,866 7,993
Токены рассуждений 0 486,670
Время ответа (среднее) 7.60s 52.06s
Время ответа (макс.) 47.72s 252.69s
Время ответа (суммарно) 167.28s 1145.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
Стоимость
$0.271
Время
149.3s
Токены
10,962 tok

#55 xAI: Grok Build 0.1

medium
Стоимость
$0.028
Время
81.3s
Токены
14,009 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

Быстрое сравнение

Сменить пару сравнения