Навигация
Advertise here

Claude Haiku 5.5 (xhigh) vs GPT-5.3-Codex (medium)

Средний балл практически равен: 9.1 vs 9.1. Claude Haiku 5.5 (xhigh) имеет более низкую стоимость benchmark: $0.140 vs $1.318. Claude Haiku 5.5 (xhigh) быстрее: 16.58s vs 18.87s, с долей успешных попыток 81.2% vs 84.1%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-07

Сравниваемые модели

Ранг
#35
Общее число выходных токенов
199,268
Время ответа (среднее)
16.58s
Общая стоимость
$0.140
Ранг
#34
Общее число выходных токенов
66,287
Время ответа (среднее)
18.87s
Общая стоимость
$1.318
Рекомендуемая модель Claude Haiku 5.5 (xhigh)

Здесь у него лучший балл (9.1), при этом он примерно в 9.5 раза дешевле, чем GPT-5.3-Codex (medium).

Подробное сравнение

Метрика Claude Haiku 5.5 Claude Haiku 5.5 xhigh Релиз: 2026-10-07 GPT-5.3-Codex GPT-5.3-Codex medium Релиз: 2026-02-05
Оценка 9.1 9.1
Ранг #35 #34
Надежность 10.0 10.0
Стабильность 9.3 8.6
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 81.2% 84.1%
Нестабильные тесты 2 4
Всего запусков 69 69
Стоимость за результат 0.773 7.753
Общая стоимость $0.140 $1.318
Цена входа $0.100 / 1M $1.750 / 1M
Цена выхода $0.500 / 1M $14.000 / 1M
Цена чтения из кэша $0.010 / 1M $0.175 / 1M
Цена записи в кэш $0.125 / 1M Н/Д
Общее число входных токенов 394,509 222,794
Выходные токены 10,349 7,357
Токены рассуждений 188,919 58,930
Время ответа (среднее) 16.58s 18.87s
Время ответа (макс.) 92.74s 100.93s
Время ответа (суммарно) 381.40s 433.94s
Параметры ~50B ~1.2T всего (~80B активных)
Доступность Закрытая модель Закрытая модель

Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Claude Haiku 5.5

xhigh
Стоимость
$0.021
Время
189.0s
Токены
41,343 tok

#34 GPT-5.3-Codex

medium
Стоимость
$0.049
Время
54.9s
Токены
3,580 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Haiku 5.5 10.0 10.0 100.0% 0 13.13s 10,608 504 26,396
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

Сменить пару сравнения