Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs Qwen: Qwen3.7 Max

Сводка

Сравнение benchmark Nemotron 3 Ultra 550b A55b vs Qwen3.7 Max: Qwen3.7 Max лидирует по среднему баллу: 9.4 vs 8.1. Nemotron 3 Ultra 550b A55b имеет более низкую стоимость benchmark: $0.158 vs $0.523. Nemotron 3 Ultra 550b A55b быстрее: 15.05s vs 16.02s, с долей успешных попыток 69.8% vs 88.9%.

Рекомендуемая модель: Nemotron 3 Ultra 550b A55b - Он дает лучший общий компромисс: конкурентный балл (8.1), ниже стоимость, чем у Qwen3.7 Max, и сбалансированное время ответа.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Релиз: 2026-06-04 Бесплатно доступно Qwen3.7 Max Qwen3.7 Max medium Релиз: 2026-05-22
Оценка 8.1 9.4
Ранг #26 #3
Надежность 9.7 10.0
Стабильность 8.8 9.6
Тестов верно
Доля успешных попыток 69.8% 88.9%
Нестабильные тесты 3 1
Всего запусков 63 63
Стоимость за результат 0.000 5.517
Общая стоимость $0.158 $0.523
Цена входа $0.500 / 1M $1.250 / 1M
Цена выхода $2.200 / 1M $3.750 / 1M
Общее число входных токенов 46,813 42,360
Выходные токены 18,002 2,129
Токены рассуждений 53,091 122,959
Время ответа (среднее) 15.05s 16.02s
Время ответа (макс.) 43.93s 59.98s
Время ответа (суммарно) 316.09s 336.51s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Nemotron 3 Ultra 550b A55b

medium
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

#3 Qwen3.7 Max

medium
Стоимость
$0.017
Время
68.8s
Токены
4,526 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 8.62s 780 835 1,485
Qwen3.7 Max 10.0 10.0 100.0% 0 6.36s 672 222 8,742
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 8.4 7.4 88.9% 1 26.53s 7,686 2,854 17,725
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 43.93s 17,574 1,040 3,590
Qwen3.7 Max 10.0 10.0 100.0% 0 19.60s 14,934 366 8,405
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 5.68s 7,989 473 1,285
Qwen3.7 Max 10.0 10.0 100.0% 0 8.80s 7,782 270 6,254
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 3.5 4.4 33.3% 2 24.90s 858 11,169 16,249
Qwen3.7 Max 5.9 7.2 55.6% 1 24.94s 771 61 31,793
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 3.7 9.5 0.0% 0 2.52s 360 70 235
Qwen3.7 Max 10.0 10.0 100.0% 0 11.70s 516 135 4,457
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 6.35s 765 182 1,243
Qwen3.7 Max 10.0 10.0 100.0% 0 7.46s 699 102 5,452
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 5.5 9.9 33.3% 0 3.54s 792 771 2,055
Qwen3.7 Max 10.0 10.0 100.0% 0 8.84s 696 259 8,908
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 7.72s 9,781 304 984
Qwen3.7 Max 10.0 10.0 100.0% 0 6.63s 8,193 267 1,220
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 38.47s 228 304 8,240
Qwen3.7 Max 3.0 10.0 0.0% 0 33.37s 204 24 12,920

Быстрое сравнение

Сменить пару сравнения