Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Nemotron 3 Ultra 550b A55b

Сводка

Сравнение benchmark DeepSeek V4 Pro vs Nemotron 3 Ultra 550b A55b: Nemotron 3 Ultra 550b A55b лидирует по среднему баллу: 7.5 vs 5.7. DeepSeek V4 Pro имеет более низкую стоимость benchmark: $0.025 vs $0.177. DeepSeek V4 Pro быстрее: 12.38s vs 15.05s, с долей успешных попыток 42.9% vs 69.8%.

Рекомендуемая модель: Nemotron 3 Ultra 550b A55b - У него самый высокий балл в этом сравнении (7.5) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-04

Метрика DeepSeek V4 Pro DeepSeek V4 Pro none Релиз: 2026-04-24 Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Релиз: 2026-06-04 Бесплатно доступно
Оценка 5.7 7.5
Ранг #113 #41
Надежность 8.5 9.7
Стабильность 8.5 8.8
Тестов верно
Доля успешных попыток 42.9% 69.8%
Нестабильные тесты 4 3
Всего запусков 63 63
Стоимость за результат 0.660 0.000
Общая стоимость $0.025 $0.177
Цена входа $0.435 / 1M $0.500 / 1M
Цена выхода $0.870 / 1M $2.500 / 1M
Общее число входных токенов 44,845 46,813
Выходные токены 5,349 18,002
Токены рассуждений 0 53,091
Время ответа (среднее) 12.38s 15.05s
Время ответа (макс.) 58.65s 43.93s
Время ответа (суммарно) 260.06s 316.09s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#113 DeepSeek V4 Pro

none
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#41 Nemotron 3 Ultra 550b A55b

medium
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 3.5 8.0 16.7% 1 14.02s 540 704 0
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 8.62s 780 835 1,485
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 4.6 7.9 22.2% 1 6.11s 7,279 531 0
Nemotron 3 Ultra 550b A55b 8.4 7.4 88.9% 1 26.53s 7,686 2,854 17,725
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 9.5 10.0 100.0% 0 25.49s 20,773 1,911 0
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 43.93s 17,574 1,040 3,590
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 6.9 5.8 66.7% 1 30.54s 5,633 170 0
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 5.68s 7,989 473 1,285
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.17s 666 18 0
Nemotron 3 Ultra 550b A55b 3.5 4.4 33.3% 2 24.90s 858 11,169 16,249
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 4.3 9.9 0.0% 0 3.75s 471 132 0
Nemotron 3 Ultra 550b A55b 3.7 9.5 0.0% 0 2.52s 360 70 235
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 6.3 10.0 50.0% 0 8.23s 627 64 0
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 6.35s 765 182 1,243
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 7.6 7.2 77.8% 1 15.95s 594 173 0
Nemotron 3 Ultra 550b A55b 5.5 9.9 33.3% 0 3.54s 792 771 2,055
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 10.0 10.0 100.0% 0 5.92s 8,079 219 0
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 7.72s 9,781 304 984
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 3.0 10.0 0.0% 0 15.59s 183 1,427 0
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 38.47s 228 304 8,240

Быстрое сравнение

Сменить пару сравнения