Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Nemotron 3.5 Lightning (high) vs GLM 5.1

Der Durchschnittsscore ist mit 5.6 vs 5.5 praktisch gleichauf. GLM 5.1 hat die niedrigeren Benchmark-Kosten mit $0.162 vs $0.167. GLM 5.1 ist schneller mit 6.70s vs 57.99s, mit Erfolgsraten von 48.5% vs 40.9%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-11

Rang
#189
Gesamte Ausgabe-Token
647,615
Antwortzeit (Durchschnitt)
57.99s
Gesamtkosten
$0.167
Rang
#190
Gesamte Ausgabe-Token
14,393
Antwortzeit (Durchschnitt)
6.70s
Gesamtkosten
$0.162
Empfohlenes Modell GLM 5.1

Es hat hier die beste Punktzahl (5.5) und antwortet etwa 8.7x schneller als Nemotron 3.5 Lightning (high).

Detaillierter Vergleich

Metrik Nemotron 3.5 Lightning Nemotron 3.5 Lightning high Veröffentlichung: 2026-08-11 Kostenlos verfügbar GLM 5.1 GLM 5.1 none Veröffentlichung: 2026-04-07
Punktzahl 5.6 5.5
Rang #189 #190
Zuverlässigkeit 9.9 10.0
Konsistenz 6.0 8.2
Benchmark-Abdeckung 22/22 Tests · 66/66 Versuche 22/22 Tests · 66/66 Versuche
Korrekte Tests
Erfolgsquote pro Versuch 48.5% 40.9%
Instabile Tests 11 5
Gesamtläufe 66 66
Kosten pro Ergebnis 0.000 2.368
Gesamtkosten $0.167 $0.162
Eingabepreis $0.100 / 1M $0.952 / 1M
Ausgabepreis $0.250 / 1M $2.992 / 1M
Gesamte Eingabe-Token 118,007 124,209
Ausgabe-Token 144,961 14,393
Denk-Token 502,654 0
Antwortzeit (Durchschnitt) 57.99s 6.70s
Antwortzeit (Maximum) 285.26s 61.20s
Antwortzeit (Gesamt) 1275.68s 147.38s

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#189 Nemotron 3.5 Lightning

high
Für dieses Modell wurde noch kein Showcase-Ergebnis generiert.
Kosten
$0.000
Zeit
-
Token
0 tok

#190 GLM 5.1

none
Ungültiges SVG
Kosten
$0.000
Zeit
300.0s
Token
0 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Nemotron 3.5 Lightning 4.4 5.1 33.3% 2 168.41s 7,623 68,533 242,319
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

Schnellvergleich

Vergleichspaar wechseln