Навигация
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.3-Codex

GPT-5.3-Codex (medium) лидирует по среднему баллу: 8.9 vs 8.6. GPT-5.3-Codex (medium) имеет более низкую стоимость benchmark: $0.920 vs $1.121. Claude Opus 5 (low) быстрее: 6.99s vs 16.96s, с долей успешных попыток 80.3% vs 83.3%.

Рекомендуемая модельGPT-5.3-Codex (medium)У него самый высокий балл в этом сравнении (8.9) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика Claude Opus 5 Claude Opus 5 low Релиз: 2026-07-25 GPT-5.3-Codex GPT-5.3-Codex medium Релиз: 2026-02-05
Оценка 8.6 8.9
Ранг #23 #18
Надежность 10.0 10.0
Стабильность 9.3 8.6
Тестов верно
Доля успешных попыток 80.3% 83.3%
Нестабильные тесты 2 4
Всего запусков 66 66
Стоимость за результат 6.593 5.748
Общая стоимость $1.121 $0.920
Цена входа $5.000 / 1M $1.750 / 1M
Цена выхода $25.000 / 1M $14.000 / 1M
Общее число входных токенов 134,773 81,268
Выходные токены 14,123 6,251
Токены рассуждений 3,896 49,274
Время ответа (среднее) 6.99s 16.96s
Время ответа (макс.) 30.67s 100.93s
Время ответа (суммарно) 153.73s 373.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Claude Opus 5

low
Стоимость
$0.062
Время
30.2s
Токены
2,615 tok

#18 GPT-5.3-Codex

medium
Стоимость
$0.049
Время
54.9s
Токены
3,580 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 5 7.8 7.4 77.8% 1 6.70s 10,590 2,442 760
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

Быстрое сравнение

Сменить пару сравнения