Навигация
AI BENCHY
Advertise here

gpt-oss-120b vs GLM 4.7 Flash (medium)

GLM 4.7 Flash (medium) лидирует по среднему баллу: 4.3 vs 3.7. gpt-oss-120b имеет более низкую стоимость benchmark: $0.010 vs $0.168. gpt-oss-120b быстрее: 21.61s vs 134.34s, с долей успешных попыток 33.3% vs 31.8%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-20

Ранг
#285
Общее число выходных токенов
51,664
Время ответа (среднее)
21.61s
Общая стоимость
$0.010
Ранг
#268
Общее число выходных токенов
419,534
Время ответа (среднее)
134.34s
Общая стоимость
$0.168
Рекомендуемая модель gpt-oss-120b

Его балл близок к лучшему здесь (3.7 против 4.3), при этом он примерно в 18.5 раза дешевле, чем GLM 4.7 Flash (medium).

Подробное сравнение

Метрика gpt-oss-120b gpt-oss-120b none Релиз: 2025-08-05 Бесплатно доступно GLM 4.7 Flash GLM 4.7 Flash medium Релиз: 2026-01-19
Оценка 3.7 4.3
Ранг #285 #268
Надежность 10.0 8.6
Стабильность 7.8 7.0
Попытки 57/66 66/66
Тестов верно
Доля успешных попыток 33.3% 31.8%
Нестабильные тесты 2 8
Всего запусков 57 66
Стоимость за результат 0.168 4.180
Общая стоимость $0.010 $0.168
Цена входа $0.030 / 1M $0.060 / 1M
Цена выхода $0.170 / 1M $0.400 / 1M
Общее число входных токенов 9,081 79,104
Выходные токены 51,664 42,254
Токены рассуждений 0 377,280
Время ответа (среднее) 21.61s 134.34s
Время ответа (макс.) 113.71s 1539.97s
Время ответа (суммарно) 345.79s 2015.13s
Параметры 117B всего (5.1B активных) 30B всего (3B активных)
Доступность Открытый исходный код Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#285 gpt-oss-120b

none
Для этой модели еще не сгенерирован результат showcase.
Стоимость
Н/Д
Время
-
Токены
0 tok

#268 GLM 4.7 Flash

medium
Неверный SVG
Стоимость
$0.000
Время
186.2s
Токены
12,112 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387

Быстрое сравнение

Сменить пару сравнения