Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs OpenAI: GPT-5.4 Nano

Сводка

Сравнение benchmark Nemotron 3 Ultra 550b A55b vs GPT-5.4 Nano: Nemotron 3 Ultra 550b A55b лидирует по среднему баллу: 8.1 vs 7.5. GPT-5.4 Nano имеет более низкую стоимость benchmark: $0.107 vs $0.177. GPT-5.4 Nano быстрее: 11.95s vs 15.05s, с долей успешных попыток 69.8% vs 63.5%.

Рекомендуемая модель: GPT-5.4 Nano - Его балл близок к лучшему здесь (7.5 против 8.1), при этом он примерно в 1.7 раза дешевле, чем Nemotron 3 Ultra 550b A55b.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-12

Метрика Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Релиз: 2026-06-04 Бесплатно доступно GPT-5.4 Nano GPT-5.4 Nano medium Релиз: 2026-03-17
Оценка 8.1 7.5
Ранг #29 #48
Надежность 9.7 10.0
Стабильность 8.8 8.4
Тестов верно
Доля успешных попыток 69.8% 63.5%
Нестабильные тесты 3 4
Всего запусков 63 63
Стоимость за результат 0.000 0.969
Общая стоимость $0.177 $0.107
Цена входа $0.500 / 1M $0.200 / 1M
Цена выхода $2.500 / 1M $1.250 / 1M
Общее число входных токенов 46,813 35,434
Выходные токены 18,002 3,014
Токены рассуждений 53,091 76,520
Время ответа (среднее) 15.05s 11.95s
Время ответа (макс.) 43.93s 94.06s
Время ответа (суммарно) 316.09s 250.98s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Nemotron 3 Ultra 550b A55b

medium
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

#48 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 8.62s 780 835 1,485
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 8.4 7.4 88.9% 1 26.53s 7,686 2,854 17,725
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 43.93s 17,574 1,040 3,590
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 5.68s 7,989 473 1,285
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 3.5 4.4 33.3% 2 24.90s 858 11,169 16,249
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 3.7 9.5 0.0% 0 2.52s 360 70 235
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 6.35s 765 182 1,243
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 5.5 9.9 33.3% 0 3.54s 792 771 2,055
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 7.72s 9,781 304 984
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 38.47s 228 304 8,240
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174

Быстрое сравнение

Сменить пару сравнения