Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5.3-Codex

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-29

Метрика Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Релиз: 2026-02-19 GPT-5.3-Codex GPT-5.3-Codex medium Релиз: 2026-02-05
Оценка 9.3 8.3
Ранг #4 #17
Надежность 10.0 10.0
Стабильность 10.0 8.4
Тестов верно
Доля успешных попыток 90.0% 81.7%
Нестабильные тесты 0 4
Всего запусков 60 60
Стоимость за результат 5.587 4.887
Общая стоимость $1.006 $0.685
Цена входа $2.000 / 1M $1.750 / 1M
Цена выхода $12.000 / 1M $14.000 / 1M
Выходные токены 1,971 2,336
Токены рассуждений 75,384 42,565
Время ответа (среднее) 20.77s 15.95s
Время ответа (макс.) 88.68s 100.93s
Время ответа (суммарно) 269.96s 319.08s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.90s 112 3,218
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 240 1,722
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 7.0 9.8 50.0% 0 54.28s 429 37,735
GPT-5.3-Codex 10.0 10.0 100.0% 0 18.45s 514 7,266
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 9.5 10.0 100.0% 0 40.61s 432 9,281
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.72s 279 3,904
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 7.7 10.0 66.7% 0 32.73s 18 12,424
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 108 1,179
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 72 2,236
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 6.90s 235 3,128
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.05s 356 1,593
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 274 982
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 6.27s 12 1,297
GPT-5.3-Codex 2.8 1.6 33.3% 1 14.43s 30 1,701

Быстрое сравнение

Сменить пару сравнения