Navigation
AI BENCHY
Advertise here

AI BENCHY Compare

Verglichene Modelle

Zusammenfassung

Benchmark-Vergleich DeepSeek V4 Pro vs DeepSeek V4 Flash vs DeepSeek V3.2DeepSeek V4 Flash führt bei Punktzahl mit 8.3. DeepSeek V4 Flash führt bei Zuverlässigkeit mit 10.0. DeepSeek V4 Flash hat den niedrigsten Gesamtkosten mit $0.027. DeepSeek V4 Flash ist mit 45.85s am schnellsten.

Empfohlenes Modell: DeepSeek V4 Flash - Es hat hier die beste Punktzahl (8.3) und kostet etwa 3.8x weniger als die anderen Modelle in diesem Vergleich.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-06-18

Metrik DeepSeek V4 Pro DeepSeek V4 Pro high Veröffentlichung: 2026-04-24 DeepSeek V4 Flash DeepSeek V4 Flash high Veröffentlichung: 2026-04-24 DeepSeek V3.2 DeepSeek V3.2 medium Veröffentlichung: 2025-12-01
Punktzahl 7.6 8.3 7.5
Rang #41 #23 #48
Zuverlässigkeit 9.3 10.0 10.0
Konsistenz 7.0 8.5 7.6
Korrekte Tests
Erfolgsquote pro Versuch 66.7% 74.6% 65.1%
Instabile Tests 8 4 6
Gesamtläufe 63 63 63
Kosten pro Ergebnis 1.742 0.299 0.436
Gesamtkosten $0.157 $0.027 $0.044
Eingabepreis $0.435 / 1M $0.090 / 1M $0.229 / 1M
Ausgabepreis $0.870 / 1M $0.180 / 1M $0.344 / 1M
Gesamte Eingabe-Token 38,726 39,745 38,333
Ausgabe-Token 6,334 10,310 7,186
Denk-Token 159,151 123,501 99,081
Antwortzeit (Durchschnitt) 77.20s 45.85s 68.71s
Antwortzeit (Maximum) 416.76s 218.13s 376.10s
Antwortzeit (Gesamt) 1621.17s 962.79s 1442.81s

Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#41 DeepSeek V4 Pro

high
Kosten
$0.023
Zeit
257.6s
Token
14,870 tok

#23 DeepSeek V4 Flash

high
Kosten
$0.003
Zeit
93.1s
Token
7,926 tok

#48 DeepSeek V3.2

medium
Kosten
$0.001
Zeit
53.6s
Token
1,932 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Anti-KI-Tricks Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 5.7 5.9 58.3% 2 25.70s 536 149 3,214
DeepSeek V4 Flash 8.3 10.0 75.0% 0 28.51s 540 140 7,770
DeepSeek V3.2 8.2 7.9 83.3% 1 24.23s 448 3,247 6,953
Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 6.1 4.6 66.7% 2 243.00s 5,090 383 84,580
DeepSeek V4 Flash 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Kombiniert Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 10.0 10.0 100.0% 0 38.17s 14,060 454 5,836
DeepSeek V4 Flash 10.0 10.0 100.0% 0 76.57s 14,016 465 7,347
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 14,283 571 6,296
Datenanalyse und -extraktion Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 10.0 10.0 100.0% 0 25.03s 7,690 274 2,166
DeepSeek V4 Flash 10.0 10.0 100.0% 0 28.03s 7,290 201 1,179
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 7,388 207 7,693
Domänenspezifisch Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 3.6 7.2 22.2% 1 151.46s 569 4,404 50,391
DeepSeek V4 Flash 4.1 4.4 44.5% 2 100.31s 666 27 59,249
DeepSeek V3.2 2.9 4.4 22.2% 2 24.27s 472 21 6,838
Allgemeine Intelligenz Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 10.0 10.0 100.0% 0 8.83s 471 115 1,013
DeepSeek V4 Flash 6.1 3.1 66.7% 1 25.15s 471 79 632
DeepSeek V3.2 3.4 2.5 33.3% 1 58.29s 314 49 2,189
Befolgung von Anweisungen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 7.8 6.6 83.3% 1 8.73s 627 66 2,726
DeepSeek V4 Flash 10.0 10.0 100.0% 0 15.36s 627 63 1,622
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 627 1,397 2,845
Rätsellösen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 6.9 4.9 77.8% 2 56.85s 591 178 2,563
DeepSeek V4 Flash 8.2 7.2 88.9% 1 26.11s 594 196 1,767
DeepSeek V3.2 7.0 7.2 55.6% 1 37.69s 594 518 6,375
Werkzeugaufrufe Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 9.8 10.0 100.0% 0 15.92s 8,909 295 701
DeepSeek V4 Flash 10.0 10.0 100.0% 0 74.73s 8,079 228 542
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 8,307 507 859
Allgemeinwissen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Pro 3.0 10.0 0.0% 0 34.01s 183 16 5,961
DeepSeek V4 Flash 3.0 10.0 0.0% 0 54.46s 183 8,516 8,531
DeepSeek V3.2 3.0 10.0 0.0% 0 83.99s 183 20 7,019

Schnellvergleich

Vergleichspaar wechseln