Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 2.5 Flash vs OpenAI: GPT-5.5

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-24

Метрика Gemini 2.5 Flash Gemini 2.5 Flash medium Релиз: 2025-06-17 GPT-5.5 GPT-5.5 medium Релиз: 2026-04-24
Оценка 8.2 9.0
Ранг #17 #5
Надежность Н/Д Н/Д
Стабильность 9.5 9.2
Тестов верно
Доля успешных попыток 75.9% 87.0%
Нестабильные тесты 1 2
Всего запусков 54 54
Стоимость за результат 2.454 19.226
Общая стоимость $0.319 $2.884
???? ????? $0.300 / 1M $5.000 / 1M
???? ?????? $2.500 / 1M $30.000 / 1M
Выходные токены 1,898 1,920
Токены рассуждений 122,273 89,632
Время ответа (среднее) 12.12s 32.75s
Время ответа (макс.) 95.48s 332.10s
Время ответа (суммарно) 218.12s 589.59s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 255 10,233
GPT-5.5 10.0 10.0 100.0% 0 4.66s 250 1,335
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 16.23s 522 10,350
GPT-5.5 10.0 10.0 100.0% 0 9.09s 318 1,391
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
GPT-5.5 10.0 10.0 100.0% 0 19.29s 312 2,841
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
GPT-5.5 10.0 10.0 100.0% 0 4.18s 234 593
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
GPT-5.5 5.3 7.2 44.4% 1 164.14s 67 79,625
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
GPT-5.5 10.0 10.0 100.0% 0 4.16s 138 223
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
GPT-5.5 10.0 10.0 100.0% 0 3.36s 93 538
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
GPT-5.5 8.6 7.9 77.8% 1 6.78s 250 2,254
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
GPT-5.5 10.0 10.0 100.0% 0 10.57s 258 832

Быстрое сравнение

Сменить пару сравнения