Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek V4 Flash 0731 vs KAT-Coder-Air V2.5 (low)

Der Durchschnittsscore ist mit 5.4 vs 5.4 praktisch gleichauf. DeepSeek V4 Flash 0731 hat die niedrigeren Benchmark-Kosten mit $0.021 vs $0.041. KAT-Coder-Air V2.5 (low) ist schneller mit 10.09s vs 20.70s, mit Erfolgsraten von 27.3% vs 45.5%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-01

Rang
#182
Gesamte Ausgabe-Token
25,424
Antwortzeit (Durchschnitt)
20.70s
Gesamtkosten
$0.021
Rang
#180
Gesamte Ausgabe-Token
52,895
Antwortzeit (Durchschnitt)
10.09s
Gesamtkosten
$0.041
Empfohlenes Modell KAT-Coder-Air V2.5 (low)

Es hat hier die beste Punktzahl (5.4) und antwortet etwa 2.1x schneller als DeepSeek V4 Flash 0731.

Detaillierter Vergleich

Metrik DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 none Veröffentlichung: 2026-08-01 KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 low Veröffentlichung: 2026-07-14
Punktzahl 5.4 5.4
Rang #182 #180
Zuverlässigkeit 10.0 9.9
Konsistenz 8.6 7.4
Korrekte Tests
Erfolgsquote pro Versuch 27.3% 45.5%
Instabile Tests 4 7
Gesamtläufe 66 66
Kosten pro Ergebnis 0.509 0.585
Gesamtkosten $0.021 $0.041
Eingabepreis $0.140 / 1M $0.150 / 1M
Ausgabepreis $0.280 / 1M $0.600 / 1M
Gesamte Eingabe-Token 94,557 61,085
Ausgabe-Token 25,424 5,905
Denk-Token 0 46,990
Antwortzeit (Durchschnitt) 20.70s 10.09s
Antwortzeit (Maximum) 387.15s 86.23s
Antwortzeit (Gesamt) 455.38s 222.03s

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#182 DeepSeek V4 Flash 0731

none
Kosten
$0.004
Zeit
198.4s
Token
14,316 tok

#180 KAT-Coder-Air V2.5

low
Kosten
$0.004
Zeit
29.9s
Token
6,008 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
DeepSeek V4 Flash 0731 4.3 10.0 0.0% 0 1.72s 7,275 505 0
KAT-Coder-Air V2.5 3.5 7.3 11.1% 1 11.06s 7,893 2,001 13,623

Schnellvergleich

Vergleichspaar wechseln