Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Gemini 3 PRO Preview vs StepFun: Step 3.7 Flash

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-29

Метрика Gemini 3 PRO Preview Gemini 3 PRO Preview medium Релиз: 2025-11-18 Step 3.7 Flash Step 3.7 Flash medium Релиз: 2026-05-29
Оценка 8.1 7.9
Ранг #22 #32
Надежность Н/Д 9.9
Стабильность 10.0 9.2
Тестов верно
Доля успешных попыток 73.7% 71.7%
Нестабильные тесты 0 2
Всего запусков 60 58
Стоимость за результат 1.406 2.663
Общая стоимость $0.197 $0.347
Цена входа $0.000 / 1M $0.200 / 1M
Цена выхода $0.000 / 1M $1.150 / 1M
Выходные токены 1,490 294,481
Токены рассуждений 10,102 0
Время ответа (среднее) 9.05s 18.32s
Время ответа (макс.) 26.24s 113.98s
Время ответа (суммарно) 90.53s 366.45s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 14.99s 149 1,485
Step 3.7 Flash 8.7 7.9 91.7% 1 9.65s 32,185 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 0ms 0 0
Step 3.7 Flash 8.2 6.7 83.3% 1 10.64s 19,320 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 10.37s 351 952
Step 3.7 Flash 10.0 10.0 100.0% 0 9.06s 7,106 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 10.84s 279 3,156
Step 3.7 Flash 10.0 10.0 100.0% 0 2.75s 3,020 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 5.3 10.0 33.3% 0 7.01s 15 1,195
Step 3.7 Flash 7.7 10.0 66.7% 0 48.27s 70,347 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 9.34s 78 374
Step 3.7 Flash 4.0 10.0 0.0% 0 6.85s 3,987 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 9.8 10.0 100.0% 0 3.26s 69 754
Step 3.7 Flash 9.8 10.0 100.0% 0 1.83s 2,166 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 3.88s 225 1,215
Step 3.7 Flash 5.7 9.9 33.3% 0 6.19s 15,071 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 11.96s 324 971
Step 3.7 Flash 10.0 10.0 100.0% 0 4.16s 2,115 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 PRO Preview 0.0 0.0 0.0% 0 0ms 0 0
Step 3.7 Flash 3.0 10.0 0.0% 0 113.98s 139,164 0

Быстрое сравнение

Сменить пару сравнения