Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: GPT-5.5

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика Gemini 3.5 Flash Gemini 3.5 Flash high Релиз: 2026-05-19 GPT-5.5 GPT-5.5 low Релиз: 2026-04-24
Оценка 9.6 8.9
Ранг #4 #10
Надежность 10.0 10.0
Стабильность 9.6 10.0
Тестов верно
Доля успешных попыток 96.5% 84.2%
Нестабильные тесты 1 0
Всего запусков 57 57
Стоимость за результат 4.294 4.412
Общая стоимость $0.773 $0.706
???? ????? $1.500 / 1M $5.000 / 1M
???? ?????? $9.000 / 1M $30.000 / 1M
Выходные токены 1,945 2,008
Токены рассуждений 78,877 16,914
Время ответа (среднее) 6.90s 8.80s
Время ответа (макс.) 22.37s 56.19s
Время ответа (суммарно) 131.10s 167.26s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.57s 174 4,997
GPT-5.5 10.0 10.0 100.0% 0 4.43s 246 1,011
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 14.42s 426 10,368
GPT-5.5 10.0 10.0 100.0% 0 7.79s 369 936
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.37s 351 16,323
GPT-5.5 10.0 10.0 100.0% 0 9.56s 303 717
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.43s 279 8,466
GPT-5.5 10.0 10.0 100.0% 0 3.28s 228 157
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.6 7.2 77.8% 1 14.09s 12 24,721
GPT-5.5 5.3 10.0 33.3% 0 27.57s 69 11,731
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.63s 115 1,650
GPT-5.5 10.0 10.0 100.0% 0 7.14s 146 170
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.35s 70 3,799
GPT-5.5 9.9 10.0 100.0% 0 2.98s 93 356
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.23s 241 4,940
GPT-5.5 10.0 10.0 100.0% 0 4.94s 274 895
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 9.8 10.0 100.0% 0 4.96s 265 1,608
GPT-5.5 10.0 10.0 100.0% 0 4.96s 250 101
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.94s 12 2,005
GPT-5.5 3.0 10.0 0.0% 0 10.06s 30 840

Быстрое сравнение

Сменить пару сравнения