Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5 Nano vs xAI: Grok 4.20 Beta

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-12

Метрика GPT-5 Nano GPT-5 Nano medium Релиз: 2025-08-07 Grok 4.20 Beta Grok 4.20 Beta none Релиз: 2026-03-12
Ранг #38 #52
Средний балл 5.5 4.4
Стабильность 7.0 9.1
Стоимость за результат 0.856 2.214
Общая стоимость $0.060 $0.089
Тестов верно
Доля успешных попыток 60.4% 33.3%
Нестабильные тесты 6 2
Всего запусков 48 48
Выходные токены 4,386 1,511
Токены рассуждений 142,080 0
Время ответа (среднее) 47.94s 1.22s
Время ответа (макс.) 204.02s 6.48s
Время ответа (суммарно) 431.47s 19.53s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Средний балл vs Время ответа (среднее)

Общее число выходных токенов

Средний балл vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Nano 7.0 10.0 66.7% 0 37.73s 1,107 19,968
Grok 4.20 Beta 3.3 7.9 22.2% 1 562ms 245 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Nano 10.0 10.0 100.0% 0 65.96s 578 17,984
Grok 4.20 Beta 10.0 10.0 0.0% 0 6.48s 282 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Nano 10.0 1.7 50.0% 2 21.42s 453 10,560
Grok 4.20 Beta 9.9 10.0 100.0% 0 601ms 197 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Nano 4.0 4.4 55.6% 2 204.02s 237 64,448
Grok 4.20 Beta 10.0 10.0 0.0% 0 611ms 160 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Nano 3.0 10.0 0.0% 0 17.51s 202 4,608
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Nano 9.0 6.8 83.3% 1 11.90s 382 4,096
Grok 4.20 Beta 4.5 10.0 0.0% 0 687ms 60 0
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Nano 4.0 7.2 44.4% 1 19.81s 869 13,440
Grok 4.20 Beta 4.0 7.2 55.6% 1 541ms 291 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5 Nano 10.0 10.0 100.0% 0 33.30s 558 6,976
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

Быстрое сравнение

Сменить пару сравнения