Navigation
Advertise here

DeepSeek V3.2 (medium) vs Ember-1 (high)

Der Durchschnittsscore ist mit 7.0 vs 7.1 praktisch gleichauf. DeepSeek V3.2 (medium) hat die niedrigeren Benchmark-Kosten mit $0.081 vs $1.798. Ember-1 (high) ist schneller mit 56.77s vs 68.43s, mit Erfolgsraten von 65.2% vs 71.2%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-09-28

Verglichene Modelle

Rang
#162
Gesamte Ausgabe-Token
128,787
Antwortzeit (Durchschnitt)
68.43s
Gesamtkosten
$0.081
Rang
#158
Gesamte Ausgabe-Token
110,125
Antwortzeit (Durchschnitt)
56.77s
Gesamtkosten
$1.798
Empfohlenes Modell DeepSeek V3.2 (medium)

Es hat hier die beste Punktzahl (7.0) und kostet etwa 22.3x weniger als Ember-1 (high).

Detaillierter Vergleich

Metrik DeepSeek V3.2 DeepSeek V3.2 medium Veröffentlichung: 2025-12-01 Ember-1 Ember-1 high Veröffentlichung: 2026-09-28
Punktzahl 7.0 7.1
Rang #162 #158
Zuverlässigkeit 10.0 8.0
Konsistenz 7.4 7.3
Versuche 66/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 65.2% 71.2%
Instabile Tests 7 7
Gesamtläufe 66 66
Kosten pro Ergebnis 0.672 14.981
Gesamtkosten $0.081 $1.798
Eingabepreis $0.280 / 1M $3.000 / 1M
Ausgabepreis $0.420 / 1M $15.000 / 1M
Gesamte Eingabe-Token 101,056 48,577
Ausgabe-Token 11,832 7,345
Denk-Token 116,955 102,780
Antwortzeit (Durchschnitt) 68.43s 56.77s
Antwortzeit (Maximum) 376.10s 255.06s
Antwortzeit (Gesamt) 1505.53s 1248.88s
Parameter 671B insgesamt (37B aktiv) ~2.8T insgesamt (~104B aktiv)
Verfügbarkeit Open Source Geschlossen

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#162 DeepSeek V3.2

medium
Kosten
$0.001
Zeit
53.6s
Token
1,932 tok

#158 Ember-1

high
Kosten
$0.038
Zeit
55.1s
Token
2,671 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093

Schnellvergleich

Vergleichspaar wechseln