Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Grok 4.1 Fast

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика Claude Sonnet 4.6 Claude Sonnet 4.6 none Релиз: 2026-02-17 Grok 4.1 Fast Grok 4.1 Fast medium Релиз: 2025-11-19
Оценка 7.2 6.5
Ранг #68 #84
Надежность 10.0 10.0
Стабильность 9.6 7.3
Тестов верно
Доля успешных попыток 61.4% 61.4%
Нестабильные тесты 1 6
Всего запусков 57 57
Стоимость за результат 2.441 0.644
Общая стоимость $0.269 $0.058
???? ????? $3.000 / 1M $0.000 / 1M
???? ?????? $15.000 / 1M $0.000 / 1M
Выходные токены 7,864 2,025
Токены рассуждений 0 96,679
Время ответа (среднее) 4.96s 24.01s
Время ответа (макс.) 23.84s 121.79s
Время ответа (суммарно) 59.50s 288.18s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 1,214 0
Grok 4.1 Fast 8.7 7.9 91.7% 1 3.81s 108 4,741
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.67s 523 0
Grok 4.1 Fast 2.3 1.1 33.3% 1 23.58s 821 6,703
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 3,766 0
Grok 4.1 Fast 10.0 10.0 100.0% 0 37.64s 261 12,272
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 252 0
Grok 4.1 Fast 10.0 10.0 100.0% 0 6.63s 180 5,409
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 413 0
Grok 4.1 Fast 5.8 4.4 66.7% 2 121.79s 11 37,657
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 192 0
Grok 4.1 Fast 4.2 9.9 0.0% 0 16.25s 127 3,456
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 90 0
Grok 4.1 Fast 6.5 10.0 50.0% 0 5.30s 55 3,489
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.92s 536 0
Grok 4.1 Fast 5.3 7.2 44.4% 1 8.08s 187 6,086
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 447 0
Grok 4.1 Fast 2.8 1.6 33.3% 1 27.71s 260 11,485
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 431 0
Grok 4.1 Fast 3.0 10.0 0.0% 0 25.52s 15 5,381

Быстрое сравнение

Сменить пару сравнения