Навигация
AI BENCHY
Advertise here

gpt-oss-120b vs Qwen3.5-9B (medium)

Средний балл практически равен: 3.7 vs 3.8. gpt-oss-120b имеет более низкую стоимость benchmark: $0.010 vs $0.062. gpt-oss-120b быстрее: 21.61s vs 107.51s, с долей успешных попыток 33.3% vs 25.8%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-20

Ранг
#285
Общее число выходных токенов
51,664
Время ответа (среднее)
21.61s
Общая стоимость
$0.010
Ранг
#282
Общее число выходных токенов
413,442
Время ответа (среднее)
107.51s
Общая стоимость
$0.062
Рекомендуемая модель gpt-oss-120b

Здесь у него лучший балл (3.7), при этом он примерно в 6.8 раза дешевле, чем Qwen3.5-9B (medium).

Подробное сравнение

Метрика gpt-oss-120b gpt-oss-120b none Релиз: 2025-08-05 Бесплатно доступно Qwen3.5-9B Qwen3.5-9B medium Релиз: 2026-03-02
Оценка 3.7 3.8
Ранг #285 #282
Надежность 10.0 6.0
Стабильность 7.8 8.1
Попытки 57/66 66/66
Тестов верно
Доля успешных попыток 33.3% 25.8%
Нестабильные тесты 2 5
Всего запусков 57 66
Стоимость за результат 0.168 2.061
Общая стоимость $0.010 $0.062
Цена входа $0.030 / 1M $0.100 / 1M
Цена выхода $0.170 / 1M $0.150 / 1M
Общее число входных токенов 9,081 17,195
Выходные токены 51,664 46,735
Токены рассуждений 0 366,707
Время ответа (среднее) 21.61s 107.51s
Время ответа (макс.) 113.71s 569.97s
Время ответа (суммарно) 345.79s 1720.15s
Параметры 117B всего (5.1B активных) 9B
Доступность Открытый исходный код Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#285 gpt-oss-120b

none
Для этой модели еще не сгенерирован результат showcase.
Стоимость
Н/Д
Время
-
Токены
0 tok

#282 Qwen3.5-9B

medium
Стоимость
$0.001
Время
35.9s
Токены
3,030 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

Быстрое сравнение

Сменить пару сравнения