Навигация
Advertise here

Gemini 3.5 Flash (medium) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) лидирует по среднему баллу: 9.6 vs 7.9. GPT-6.1 Sol (low) имеет более низкую стоимость benchmark: $0.460 vs $1.316. GPT-6.1 Sol (low) быстрее: 7.15s vs 11.78s, с долей успешных попыток 81.2% vs 92.8%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-02

Сравниваемые модели

Ранг
#101
Общее число выходных токенов
96,655
Время ответа (среднее)
11.78s
Общая стоимость
$1.316
Ранг
#16
Общее число выходных токенов
13,138
Время ответа (среднее)
7.15s
Общая стоимость
$0.460
Рекомендуемая модель GPT-6.1 Sol (low)

Здесь у него лучший балл (9.6), при этом он примерно в 2.9 раза дешевле, чем Gemini 3.5 Flash (medium).

Подробное сравнение

Метрика Gemini 3.5 Flash Gemini 3.5 Flash medium Релиз: 2026-05-19 GPT-6.1 Sol GPT-6.1 Sol low Релиз: 2026-09-29
Оценка 7.9 9.6
Ранг #101 #16
Надежность 10.0 10.0
Стабильность 9.3 9.6
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 81.2% 92.8%
Нестабильные тесты 2 1
Всего запусков 69 69
Стоимость за результат 7.306 2.187
Общая стоимость $1.316 $0.460
Цена входа $1.500 / 1M $2.000 / 1M
Цена выхода $9.000 / 1M $10.000 / 1M
Цена чтения из кэша $0.150 / 1M $0.100 / 1M
Цена записи в кэш $0.084 / 1M $2.500 / 1M
Общее число входных токенов 296,760 163,900
Выходные токены 4,371 4,958
Токены рассуждений 92,284 8,180
Время ответа (среднее) 11.78s 7.15s
Время ответа (макс.) 84.47s 46.57s
Время ответа (суммарно) 271.03s 164.47s
Параметры ~500B всего (~20B активных) ~2T всего (~150B активных)
Доступность Закрытая модель Закрытая модель

Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#101 Gemini 3.5 Flash

medium
Стоимость
$0.201
Время
112.9s
Токены
22,371 tok

#16 GPT-6.1 Sol

low
Стоимость
$0.028
Время
44.6s
Токены
2,881 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash 7.9 7.5 77.8% 1 12.63s 8,118 461 24,939
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

Быстрое сравнение

Сменить пару сравнения