Навигация
Advertise here

gpt-oss-120b (medium) vs Qwen3.7 Flash

Средний балл практически равен: 6.1 vs 6.1. Qwen3.7 Flash имеет более низкую стоимость benchmark: $0.019 vs $0.020. Qwen3.7 Flash быстрее: 10.05s vs 20.81s, с долей успешных попыток 50.0% vs 36.4%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-10

Сравниваемые модели

Ранг
#198
Общее число выходных токенов
98,282
Время ответа (среднее)
20.81s
Общая стоимость
$0.020
Ранг
#199
Общее число выходных токенов
90,507
Время ответа (среднее)
10.05s
Общая стоимость
$0.019
Рекомендуемая модель Qwen3.7 Flash

Здесь у него лучший балл (6.1), и он отвечает примерно в 2.1 раза быстрее, чем gpt-oss-120b (medium).

Подробное сравнение

Метрика gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05 Qwen3.7 Flash Qwen3.7 Flash none Релиз: 2026-07-28
Оценка 6.1 6.1
Ранг #198 #199
Надежность 10.0 10.0
Стабильность 8.0 9.2
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 50.0% 36.4%
Нестабильные тесты 5 2
Всего запусков 66 66
Стоимость за результат 0.224 0.262
Общая стоимость $0.020 $0.019
Цена входа $0.037 / 1M $0.030 / 1M
Цена выхода $0.170 / 1M $0.130 / 1M
Общее число входных токенов 108,767 218,740
Выходные токены 29,378 90,507
Токены рассуждений 68,904 0
Время ответа (среднее) 20.81s 10.05s
Время ответа (макс.) 68.16s 186.24s
Время ответа (суммарно) 332.88s 221.13s
Параметры 117B всего (5.1B активных) ~35B всего (~3B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#198 gpt-oss-120b

medium
Стоимость
$0.001
Время
26.7s
Токены
555 tok

#199 Qwen3.7 Flash

none
Стоимость
$0.001
Время
34.0s
Токены
4,814 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.7 Flash 5.5 10.0 33.3% 0 1.55s 7,911 855 0

Быстрое сравнение

Сменить пару сравнения