Навигация
AI BENCHY
Advertise here

gpt-oss-120b (medium) vs Qwen3.5-35B-A3B (medium)

Средний балл практически равен: 6.1 vs 6.1. gpt-oss-120b (medium) имеет более низкую стоимость benchmark: $0.020 vs $1.140. gpt-oss-120b (medium) быстрее: 20.81s vs 110.84s, с долей успешных попыток 50.0% vs 65.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-26

Ранг
#173
Общее число выходных токенов
98,282
Время ответа (среднее)
20.81s
Общая стоимость
$0.020
Ранг
#172
Общее число выходных токенов
893,463
Время ответа (среднее)
110.84s
Общая стоимость
$1.140
Рекомендуемая модель gpt-oss-120b (medium)

Здесь у него лучший балл (6.1), при этом он примерно в 59.9 раза дешевле, чем Qwen3.5-35B-A3B (medium).

Подробное сравнение

Метрика gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Релиз: 2026-02-24
Оценка 6.1 6.1
Ранг #173 #172
Надежность 10.0 10.0
Стабильность 8.0 7.6
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 50.0% 65.2%
Нестабильные тесты 5 6
Всего запусков 66 66
Стоимость за результат 0.224 9.806
Общая стоимость $0.020 $1.140
Цена входа $0.037 / 1M $0.250 / 1M
Цена выхода $0.170 / 1M $1.250 / 1M
Общее число входных токенов 108,767 130,450
Выходные токены 29,378 54,857
Токены рассуждений 68,904 838,606
Время ответа (среднее) 20.81s 110.84s
Время ответа (макс.) 68.16s 950.25s
Время ответа (суммарно) 332.88s 2438.58s
Параметры 117B всего (5.1B активных) 35B всего (3B активных)
Доступность Открытый исходный код Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#173 gpt-oss-120b

medium
Стоимость
$0.001
Время
26.7s
Токены
555 tok

#172 Qwen3.5-35B-A3B

medium
Стоимость
$0.009
Время
71.4s
Токены
8,631 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

Быстрое сравнение

Сменить пару сравнения