Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: GPT-5.5

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика Gemini 3.5 Flash Gemini 3.5 Flash medium Релиз: 2026-05-19 GPT-5.5 GPT-5.5 low Релиз: 2026-04-24
Оценка 9.2 8.9
Ранг #5 #10
Надежность 10.0 10.0
Стабильность 10.0 10.0
Тестов верно
Доля успешных попыток 89.5% 84.2%
Нестабильные тесты 0 0
Всего запусков 57 57
Стоимость за результат 2.307 4.412
Общая стоимость $0.393 $0.706
???? ????? $1.500 / 1M $5.000 / 1M
???? ?????? $9.000 / 1M $30.000 / 1M
Выходные токены 1,971 2,008
Токены рассуждений 36,659 16,914
Время ответа (среднее) 3.90s 8.80s
Время ответа (макс.) 12.05s 56.19s
Время ответа (суммарно) 74.13s 167.26s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.09s 171 3,385
GPT-5.5 10.0 10.0 100.0% 0 4.43s 246 1,011
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 8.22s 431 5,190
GPT-5.5 10.0 10.0 100.0% 0 7.79s 369 936
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 12.05s 351 7,807
GPT-5.5 10.0 10.0 100.0% 0 9.56s 303 717
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 4.07s 279 3,784
GPT-5.5 10.0 10.0 100.0% 0 3.28s 228 157
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.7 10.0 66.7% 0 5.24s 12 8,047
GPT-5.5 5.3 10.0 33.3% 0 27.57s 69 11,731
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 115 1,144
GPT-5.5 10.0 10.0 100.0% 0 7.14s 146 170
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 9.9 10.0 100.0% 0 2.70s 71 2,855
GPT-5.5 9.9 10.0 100.0% 0 2.98s 93 356
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.7 10.0 66.7% 0 2.38s 295 2,747
GPT-5.5 10.0 10.0 100.0% 0 4.94s 274 895
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.81s 234 455
GPT-5.5 10.0 10.0 100.0% 0 4.96s 250 101
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.75s 12 1,245
GPT-5.5 3.0 10.0 0.0% 0 10.06s 30 840

Быстрое сравнение

Сменить пару сравнения