AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs Qwen: Qwen3.6 Max Preview

Zusammenfassung

Nemotron 3 Ultra 550b A55b vs Qwen3.6 Max Preview Benchmark-Vergleich: Qwen3.6 Max Preview führt beim Durchschnittsscore mit 8.5 vs 7.5. Nemotron 3 Ultra 550b A55b hat die niedrigeren Benchmark-Kosten mit $0.177 vs $0.960. Nemotron 3 Ultra 550b A55b ist schneller mit 15.05s vs 59.63s, mit Erfolgsraten von 69.8% vs 81.0%.

Empfohlenes Modell: Nemotron 3 Ultra 550b A55b - Es bietet den besten Gesamtkompromiss: wettbewerbsfähige Punktzahl (7.5), niedrigere Kosten als Qwen3.6 Max Preview und ausgewogene Antwortzeit.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-06-10

Metrik	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Veröffentlichung: 2026-06-04 Kostenlos verfügbar	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Veröffentlichung: 2026-04-20

Metrik	Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium Veröffentlichung: 2026-06-04 Kostenlos verfügbar	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Veröffentlichung: 2026-04-20
Punktzahl	7.5	8.5
Rang	#42	#15
Zuverlässigkeit	9.7	10.0
Konsistenz	8.8	9.3
Korrekte Tests
Erfolgsquote pro Versuch	69.8%	81.0%
Instabile Tests	3	2
Gesamtläufe	63	63
Kosten pro Ergebnis	0.000	7.024
Gesamtkosten	$0.177	$0.960
Eingabepreis	$0.500 / 1M	$1.040 / 1M
Ausgabepreis	$2.500 / 1M	$6.240 / 1M
Gesamte Eingabe-Token	46,813	42,362
Ausgabe-Token	18,002	2,273
Denk-Token	53,091	144,367
Antwortzeit (Durchschnitt)	15.05s	59.63s
Antwortzeit (Maximum)	43.93s	238.07s
Antwortzeit (Gesamt)	316.09s	1252.17s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Nemotron 3 Ultra 550b A55b

medium

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

#15 Qwen3.6 Max Preview

medium

Cost: $0.024
Time: 76.5s
Tokens: 3,861 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Anti-KI-Tricks	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		8.62s	780	835	1,485
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		22.13s	672	228	10,075

Programmierung	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	8.4	7.4	88.9%	1		26.53s	7,686	2,854	17,725
Qwen3.6 Max Preview	8.8	7.8	88.9%	1		146.48s	7,895	427	52,957

Kombiniert	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		43.93s	17,574	1,040	3,590
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		121.49s	14,934	390	14,575

Datenanalyse und -extraktion	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		5.68s	7,989	473	1,285
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		41.15s	7,782	270	10,106

Domänenspezifisch	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	3.5	4.4	33.3%	2		24.90s	858	11,169	16,249
Qwen3.6 Max Preview	2.9	7.2	11.1%	1		95.91s	771	60	30,371

Allgemeine Intelligenz	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	3.7	9.5	0.0%	0		2.52s	360	70	235
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		32.24s	516	129	3,510

Befolgung von Anweisungen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	9.8	10.0	100.0%	0		6.35s	765	182	1,243
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.31s	699	103	5,848

Rätsellösen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	5.5	9.9	33.3%	0		3.54s	792	771	2,055
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.32s	696	329	7,693

Werkzeugaufrufe	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	10.0	10.0	100.0%	0		7.72s	9,781	304	984
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		18.32s	8,193	309	1,571

Allgemeinwissen	Punktzahl	Konsistenz	Erfolgsquote pro Versuch	Instabile Tests	Korrekte Tests	Antwortzeit (Durchschnitt)	Eingabe-Token	Ausgabe-Token	Denk-Token
Nemotron 3 Ultra 550b A55b	3.0	10.0	0.0%	0		38.47s	228	304	8,240
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		60.56s	204	28	7,661

Schnellvergleich

Vergleichspaar wechseln