Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5.4

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-04

Метрика Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Релиз: 2026-02-19 GPT-5.4 GPT-5.4 medium Релиз: 2026-03-05
Оценка 9.4 8.0
Ранг #4 #21
Надежность 10.0 10.0
Стабильность 10.0 8.6
Тестов верно
Доля успешных попыток 90.5% 76.2%
Нестабильные тесты 0 4
Всего запусков 63 63
Стоимость за результат 5.546 8.640
Общая стоимость $1.054 $1.210
Цена входа $2.000 / 1M $2.500 / 1M
Цена выхода $12.000 / 1M $15.000 / 1M
Общее число входных токенов 41,617 34,108
Выходные токены 1,977 2,242
Токены рассуждений 78,896 72,707
Время ответа (среднее) 20.14s 22.35s
Время ответа (макс.) 88.68s 100.41s
Время ответа (суммарно) 281.92s 469.29s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.90s 498 112 3,218
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 9.5 10.0 100.0% 0 40.61s 17,240 432 9,281
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.72s 7,265 279 3,904
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 7.7 10.0 66.7% 0 32.73s 635 18 12,424
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 490 108 1,179
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 621 72 2,236
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 6.90s 570 235 3,128
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 6,018 274 982
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 6.27s 156 12 1,297
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

Быстрое сравнение

Сменить пару сравнения