Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs OpenAI: GPT-5.4 Mini

Claude Opus 5 лидирует по среднему баллу: 7.5 vs 7.5. GPT-5.4 Mini (medium) имеет более низкую стоимость benchmark: $0.756 vs $1.550. Claude Opus 5 быстрее: 7.60s vs 25.94s, с долей успешных попыток 57.6% vs 71.2%.

Рекомендуемая модельClaude Opus 5Здесь у него лучший балл (7.5), и он отвечает примерно в 3.4 раза быстрее, чем GPT-5.4 Mini (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика Claude Opus 5 Claude Opus 5 none Релиз: 2026-07-25 GPT-5.4 Mini GPT-5.4 Mini medium Релиз: 2026-03-17
Оценка 7.5 7.5
Ранг #59 #64
Надежность 10.0 10.0
Стабильность 9.6 7.7
Тестов верно
Доля успешных попыток 57.6% 71.2%
Нестабильные тесты 1 6
Всего запусков 66 66
Стоимость за результат 12.912 6.299
Общая стоимость $1.550 $0.756
Цена входа $5.000 / 1M $0.750 / 1M
Цена выхода $25.000 / 1M $4.500 / 1M
Общее число входных токенов 185,550 97,155
Выходные токены 24,866 6,211
Токены рассуждений 0 145,544
Время ответа (среднее) 7.60s 25.94s
Время ответа (макс.) 47.72s 138.75s
Время ответа (суммарно) 167.28s 570.66s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
Стоимость
$0.271
Время
149.3s
Токены
10,962 tok

#64 GPT-5.4 Mini

medium
Стоимость
$0.056
Время
95.5s
Токены
12,464 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902

Быстрое сравнение

Сменить пару сравнения