Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

NVIDIA: Nemotron 3 Super vs OpenAI: GPT-5.4 Mini

Сводка

Сравнение benchmark Nemotron 3 Super vs GPT-5.4 Mini: Nemotron 3 Super лидирует по среднему баллу: 6.3 vs 5.3. Nemotron 3 Super имеет более низкую стоимость benchmark: $0.021 vs $0.038. GPT-5.4 Mini быстрее: 1.13s vs 32.00s, с долей успешных попыток 41.3% vs 30.2%.

Рекомендуемая модель: Nemotron 3 Super - Здесь у него лучший балл (6.3), при этом он примерно в 1.8 раза дешевле, чем GPT-5.4 Mini.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-12

Метрика Nemotron 3 Super Nemotron 3 Super medium Релиз: 2026-03-11 Бесплатно доступно GPT-5.4 Mini GPT-5.4 Mini none Релиз: 2026-03-17
Оценка 6.3 5.3
Ранг #86 #131
Надежность 10.0 10.0
Стабильность 9.2 8.8
Тестов верно
Доля успешных попыток 41.3% 30.2%
Нестабильные тесты 2 3
Всего запусков 63 63
Стоимость за результат 0.004 0.743
Общая стоимость $0.021 $0.038
Цена входа $0.090 / 1M $0.750 / 1M
Цена выхода $0.450 / 1M $4.500 / 1M
Общее число входных токенов 37,527 34,244
Выходные токены 14,850 2,541
Токены рассуждений 33,754 0
Время ответа (среднее) 32.00s 1.13s
Время ответа (макс.) 232.25s 2.52s
Время ответа (суммарно) 607.91s 23.82s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 Nemotron 3 Super

medium
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

#131 GPT-5.4 Mini

none
Cost
$0.010
Time
11.7s
Tokens
2,151 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 8.3 10.0 75.0% 0 7.85s 686 748 1,305
GPT-5.4 Mini 3.1 8.1 8.3% 1 929ms 606 654 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 3.1 10.0 0.0% 0 147.32s 2,275 797 4,424
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 10.0 10.0 100.0% 0 87.80s 15,561 2,021 9,996
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.52s 11,019 298 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 10.0 10.0 100.0% 0 18.16s 7,944 877 2,607
GPT-5.4 Mini 10.0 10.0 100.0% 0 1.30s 7,140 222 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 2.9 4.4 22.2% 2 16.19s 456 5,255 6,072
GPT-5.4 Mini 3.5 4.4 33.3% 2 937ms 723 88 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 4.1 10.0 0.0% 0 6.91s 492 105 363
GPT-5.4 Mini 4.8 10.0 0.0% 0 1.82s 477 174 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 7.3 10.0 50.0% 0 6.97s 723 956 2,383
GPT-5.4 Mini 6.3 10.0 50.0% 0 728ms 660 101 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 3.0 10.0 0.0% 0 3.15s 708 570 1,322
GPT-5.4 Mini 5.4 10.0 33.3% 0 836ms 642 305 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 10.0 10.0 100.0% 0 39.75s 8,544 270 1,969
GPT-5.4 Mini 3.0 10.0 0.0% 0 2.32s 5,477 255 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Super 3.0 10.0 0.0% 0 55.32s 138 3,251 3,313
GPT-5.4 Mini 3.0 10.0 0.0% 0 1.33s 195 43 0

Быстрое сравнение

Сменить пару сравнения