Навигация
AI BENCHY
Advertise here

gpt-oss-120b vs Grok 4.20

Grok 4.20 лидирует по среднему баллу: 4.1 vs 3.7. gpt-oss-120b имеет более низкую стоимость benchmark: $0.010 vs $0.057. Grok 4.20 быстрее: 1.11s vs 21.61s, с долей успешных попыток 33.3% vs 27.3%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-20

Ранг
#285
Общее число выходных токенов
51,664
Время ответа (среднее)
21.61s
Общая стоимость
$0.010
Ранг
#271
Общее число выходных токенов
1,923
Время ответа (среднее)
1.11s
Общая стоимость
$0.057
Рекомендуемая модель Grok 4.20

Здесь у него лучший балл (4.1), и он отвечает примерно в 19.5 раза быстрее, чем gpt-oss-120b.

Подробное сравнение

Метрика gpt-oss-120b gpt-oss-120b none Релиз: 2025-08-05 Бесплатно доступно Grok 4.20 Grok 4.20 none Релиз: 2026-03-31
Оценка 3.7 4.1
Ранг #285 #271
Надежность 10.0 Н/Д
Стабильность 7.8 8.1
Попытки 57/66 54/66
Тестов верно
Доля успешных попыток 33.3% 27.3%
Нестабильные тесты 2 0
Всего запусков 57 54
Стоимость за результат 0.168 1.570
Общая стоимость $0.010 $0.057
Цена входа $0.030 / 1M $1.250 / 1M
Цена выхода $0.170 / 1M $2.500 / 1M
Общее число входных токенов 9,081 41,313
Выходные токены 51,664 1,923
Токены рассуждений 0 0
Время ответа (среднее) 21.61s 1.11s
Время ответа (макс.) 113.71s 6.04s
Время ответа (суммарно) 345.79s 19.96s
Параметры 117B всего (5.1B активных) ~1T всего (~100B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#285 gpt-oss-120b

none
Для этой модели еще не сгенерирован результат showcase.
Стоимость
Н/Д
Время
-
Токены
0 tok

#271 xAI: Grok 4.20

none
Стоимость
$0.004
Время
6.5s
Токены
1,367 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

Быстрое сравнение

Сменить пару сравнения

Ling 3.0 Tinymediumvsgpt-oss-120bnoneБесплатно доступноgpt-oss-120bnoneБесплатно доступноvsQwen3.5-9BmediumLing 3.0 Tinylowvsgpt-oss-120bnoneБесплатно доступноLing 3.0 Tinyhighvsgpt-oss-120bnoneБесплатно доступноGrok 4.20nonevsGLM 4.7 FlashmediumLing 3.0 TinyhighvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneQwen3.5-9BmediumvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneMiniMax M2.5mediumvsGrok 4.20noneQwen3 Coder NextmediumvsGrok 4.20nonegpt-oss-120bnoneБесплатно доступноvsGLM 4.7 Flashmedium