Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs OpenAI: GPT-5.4

Сводка

Сравнение benchmark Nemotron 3 Ultra 550b A55b vs GPT-5.4: Nemotron 3 Ultra 550b A55b лидирует по среднему баллу: 6.1 vs 5.8. Nemotron 3 Ultra 550b A55b имеет более низкую стоимость benchmark: $0.027 vs $0.122. GPT-5.4 быстрее: 1.42s vs 2.27s, с долей успешных попыток 44.4% vs 36.5%.

Рекомендуемая модель: Nemotron 3 Ultra 550b A55b - Здесь у него лучший балл (6.1), при этом он примерно в 4.6 раза дешевле, чем GPT-5.4.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b none Релиз: 2026-06-04 Бесплатно доступно GPT-5.4 GPT-5.4 none Релиз: 2026-03-05
Оценка 6.1 5.8
Ранг #99 #112
Надежность 10.0 10.0
Стабильность 9.2 9.2
Тестов верно
Доля успешных попыток 44.4% 36.5%
Нестабильные тесты 2 2
Всего запусков 63 63
Стоимость за результат 0.000 1.740
Общая стоимость $0.027 $0.122
Цена входа $0.500 / 1M $2.500 / 1M
Цена выхода $2.200 / 1M $15.000 / 1M
Общее число входных токенов 43,326 34,212
Выходные токены 2,138 2,417
Токены рассуждений 0 0
Время ответа (среднее) 2.27s 1.42s
Время ответа (макс.) 13.49s 2.95s
Время ответа (суммарно) 47.65s 29.87s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#99 Nemotron 3 Ultra 550b A55b

none
Стоимость
$0.000
Время
149.6s
Токены
3,405 tok

#112 GPT-5.4

none
Стоимость
$0.026
Время
18.1s
Токены
1,792 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 3.5 8.0 16.7% 1 2.35s 696 239 0
GPT-5.4 3.2 8.0 8.3% 1 1.21s 606 406 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 5.5 10.0 33.3% 0 1.02s 7,623 369 0
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 4.79s 15,558 357 0
GPT-5.4 3.0 10.0 0.0% 0 2.89s 11,019 291 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 1.94s 7,944 249 0
GPT-5.4 10.0 10.0 100.0% 0 1.04s 7,140 222 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 5.3 10.0 33.3% 0 698ms 789 27 0
GPT-5.4 5.3 7.2 44.4% 1 1.07s 723 50 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 5.0 10.0 0.0% 0 13.49s 516 101 0
GPT-5.4 4.4 9.9 0.0% 0 1.78s 477 184 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 1.46s 723 69 0
GPT-5.4 6.5 10.0 50.0% 0 1.07s 660 81 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 5.9 7.2 55.6% 1 1.06s 726 352 0
GPT-5.4 5.6 9.8 33.3% 0 1.44s 642 381 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 2.99s 8,544 264 0
GPT-5.4 10.0 10.0 100.0% 0 2.75s 5,445 246 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 1.83s 207 111 0
GPT-5.4 3.0 10.0 0.0% 0 990ms 195 40 0

Быстрое сравнение

Сменить пару сравнения