Navigatie
Advertise here

DeepSeek V3.2 vs KAT Coder AIR V2.5 (default)

DeepSeek V3.2 leidt in gemiddelde score met 4.6 vs 4.4. KAT Coder AIR V2.5 (default) heeft lagere benchmarkkosten met $0.070 vs $0.119. KAT Coder AIR V2.5 (default) is sneller met 11.96s vs 22.44s, met slagingspercentages van 34.8% vs 34.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#334
Totaal aantal uitvoer-tokens
57,866
Responstijd (gem.)
22.44s
Totale kosten
$0.119
Rang
#348
Totaal aantal uitvoer-tokens
97,752
Responstijd (gem.)
11.96s
Totale kosten
$0.070
Aanbevolen model KAT Coder AIR V2.5 (default)

De score blijft dicht bij de beste score hier (4.4 vs 4.6) en het kost ongeveer 1.7x minder dan DeepSeek V3.2.

Gedetailleerde vergelijking

Metriek DeepSeek V3.2 DeepSeek V3.2 none Releasedatum: 2025-12-01 KAT Coder AIR V2.5 KAT Coder AIR V2.5 default Releasedatum: 2026-07-14
Score 4.6 4.4
Rang #334 #348
Betrouwbaarheid 10.0 10.0
Consistentie 8.2 7.4
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 34.8% 34.8%
Instabiele tests 5 7
Totaal runs 69 69
Kosten per resultaat 1.943 1.382
Totale kosten $0.119 $0.070
Invoerprijs $0.280 / 1M $0.150 / 1M
Uitvoerprijs $0.420 / 1M $0.600 / 1M
Prijs voor cachelezen $0.028 / 1M n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 342,158 69,376
Uitvoer-tokens 32,853 7,792
Redeneer-tokens 25,013 89,960
Responstijd (gem.) 22.44s 11.96s
Responstijd (max) 122.50s 121.05s
Responstijd (totaal) 516.03s 275.18s
Parameters 671B totaal (37B actief) ~35B totaal (~3B actief)
Beschikbaarheid Open-source Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#334 DeepSeek V3.2

none
Kosten
$0.002
Tijd
7.0s
Tokens
1,046 tok

#348 KAT Coder AIR V2.5

default
Kosten
$0.002
Tijd
14.5s
Tokens
2,619 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
KAT Coder AIR V2.5 3.3 9.6 0.0% 0 14.31s 6,472 2,032 14,886

Snelle vergelijking

Vergelijkingspaar wisselen