Навигация
AI BENCHY
Advertise here

Anthropic: Claude Sonnet 4.6 vs OpenAI: GPT-5.3-Codex

GPT-5.3-Codex (medium) лидирует по среднему баллу: 8.9 vs 7.3. Claude Sonnet 4.6 имеет более низкую стоимость benchmark: $0.661 vs $0.920. Claude Sonnet 4.6 быстрее: 8.12s vs 16.96s, с долей успешных попыток 57.6% vs 83.3%.

Рекомендуемая модельGPT-5.3-Codex (medium)У него самый высокий балл в этом сравнении (8.9) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика Claude Sonnet 4.6 Claude Sonnet 4.6 none Релиз: 2026-02-17 GPT-5.3-Codex GPT-5.3-Codex medium Релиз: 2026-02-05
Оценка 7.3 8.9
Ранг #71 #18
Надежность 10.0 10.0
Стабильность 9.7 8.6
Тестов верно
Доля успешных попыток 57.6% 83.3%
Нестабильные тесты 1 4
Всего запусков 66 66
Стоимость за результат 5.502 5.748
Общая стоимость $0.661 $0.920
Цена входа $3.000 / 1M $1.750 / 1M
Цена выхода $15.000 / 1M $14.000 / 1M
Общее число входных токенов 123,264 81,268
Выходные токены 19,362 6,251
Токены рассуждений 0 49,274
Время ответа (среднее) 8.12s 16.96s
Время ответа (макс.) 51.18s 100.93s
Время ответа (суммарно) 121.78s 373.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Sonnet 4.6

none
Стоимость
$0.038
Время
27.3s
Токены
2,598 tok

#18 GPT-5.3-Codex

medium
Стоимость
$0.049
Время
54.9s
Токены
3,580 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

Быстрое сравнение

Сменить пару сравнения