Навигация
AI BENCHY
Advertise here

gpt-oss-120b (medium) vs Qwen3.5-Flash (medium)

Средний балл практически равен: 6.1 vs 6.1. gpt-oss-120b (medium) имеет более низкую стоимость benchmark: $0.019 vs $0.142. gpt-oss-120b (medium) быстрее: 20.81s vs 84.44s, с долей успешных попыток 50.0% vs 65.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-15

Ранг
#169
Общее число выходных токенов
98,282
Время ответа (среднее)
20.81s
Общая стоимость
$0.019
Ранг
#172
Общее число выходных токенов
512,846
Время ответа (среднее)
84.44s
Общая стоимость
$0.142
Рекомендуемая модель gpt-oss-120b (medium)

Здесь у него лучший балл (6.1), при этом он примерно в 7.7 раза дешевле, чем Qwen3.5-Flash (medium).

Подробное сравнение

Метрика gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05 Qwen3.5-Flash Qwen3.5-Flash medium Релиз: 2026-02-24
Оценка 6.1 6.1
Ранг #169 #172
Надежность 10.0 10.0
Стабильность 8.0 7.8
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 50.0% 65.2%
Нестабильные тесты 5 6
Всего запусков 66 66
Стоимость за результат 0.224 1.491
Общая стоимость $0.019 $0.142
Цена входа $0.030 / 1M $0.065 / 1M
Цена выхода $0.170 / 1M $0.260 / 1M
Общее число входных токенов 108,767 118,508
Выходные токены 29,378 35,457
Токены рассуждений 68,904 477,389
Время ответа (среднее) 20.81s 84.44s
Время ответа (макс.) 68.16s 515.38s
Время ответа (суммарно) 332.88s 1773.20s
Параметры 117B всего (5.1B активных) ~35B всего (~3B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#169 gpt-oss-120b

medium
Стоимость
$0.001
Время
26.7s
Токены
555 tok

#172 Qwen3.5-Flash

medium
Стоимость
$0.002
Время
25.8s
Токены
4,294 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.5-Flash 3.7 7.2 22.2% 1 58.87s 6,685 302 90,081

Быстрое сравнение

Сменить пару сравнения