Навигация
AI BENCHY
Advertise here

Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5.3-Codex

Gemini 3.1 Pro Preview (medium) лидирует по среднему баллу: 9.2 vs 8.9. GPT-5.3-Codex (medium) имеет более низкую стоимость benchmark: $0.920 vs $1.361. GPT-5.3-Codex (medium) быстрее: 16.96s vs 21.47s, с долей успешных попыток 90.9% vs 83.3%.

Рекомендуемая модельGPT-5.3-Codex (medium)Он дает лучший общий компромисс: конкурентный балл (8.9), ниже стоимость, чем у Gemini 3.1 Pro Preview (medium), и сбалансированное время ответа.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Релиз: 2026-02-19 GPT-5.3-Codex GPT-5.3-Codex medium Релиз: 2026-02-05
Оценка 9.2 8.9
Ранг #10 #18
Надежность 10.0 10.0
Стабильность 10.0 8.6
Тестов верно
Доля успешных попыток 90.9% 83.3%
Нестабильные тесты 0 4
Всего запусков 66 66
Стоимость за результат 6.801 5.748
Общая стоимость $1.361 $0.920
Цена входа $2.000 / 1M $1.750 / 1M
Цена выхода $12.000 / 1M $14.000 / 1M
Общее число входных токенов 92,287 81,268
Выходные токены 5,232 6,251
Токены рассуждений 92,726 49,274
Время ответа (среднее) 21.47s 16.96s
Время ответа (макс.) 88.68s 100.93s
Время ответа (суммарно) 322.08s 373.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 Gemini 3.1 Pro Preview

medium
Стоимость
$0.115
Время
87.2s
Токены
9,629 tok

#18 GPT-5.3-Codex

medium
Стоимость
$0.049
Время
54.9s
Токены
3,580 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

Быстрое сравнение

Сменить пару сравнения