Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

KAT Coder AIR V2.5 (high) vs GPT-5.6 Luna

GPT-5.6 Luna leidt in gemiddelde score met 5.3 vs 5.2. GPT-5.6 Luna heeft lagere benchmarkkosten met $0.042 vs $0.077. GPT-5.6 Luna is sneller met 3.78s vs 15.23s, met slagingspercentages van 40.6% vs 34.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#306
Totaal aantal uitvoer-tokens
114,654
Responstijd (gem.)
15.23s
Totale kosten
$0.077
Rang
#297
Totaal aantal uitvoer-tokens
8,000
Responstijd (gem.)
3.78s
Totale kosten
$0.042
Aanbevolen model GPT-5.6 Luna

Het heeft hier de beste score (5.3) en kost ongeveer 1.8x minder dan KAT Coder AIR V2.5 (high).

Gedetailleerde vergelijking

Metriek KAT Coder AIR V2.5 KAT Coder AIR V2.5 high Releasedatum: 2026-07-14 GPT-5.6 Luna GPT-5.6 Luna none Releasedatum: 2026-07-09
Score 5.2 5.3
Rang #306 #297
Betrouwbaarheid 9.8 10.0
Consistentie 8.2 8.8
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 40.6% 34.8%
Instabiele tests 5 3
Totaal runs 69 69
Kosten per resultaat 1.091 2.814
Totale kosten $0.077 $0.042
Invoerprijs $0.150 / 1M $0.200 / 1M
Uitvoerprijs $0.600 / 1M $1.200 / 1M
Prijs voor cachelezen n.v.t. $0.020 / 1M
Prijs voor cacheschrijven n.v.t. $0.250 / 1M
Totaal aantal invoer-tokens 50,423 230,744
Uitvoer-tokens 4,144 8,000
Redeneer-tokens 110,510 0
Responstijd (gem.) 15.23s 3.78s
Responstijd (max) 118.35s 53.77s
Responstijd (totaal) 350.26s 86.83s
Parameters ~35B totaal (~3B actief) ~400B totaal (~17B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#306 KAT Coder AIR V2.5

high
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
300.0s
Tokens
0 tok

#297 GPT-5.6 Luna

none
Kosten
$0.016
Tijd
15.8s
Tokens
2,685 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
KAT Coder AIR V2.5 4.3 7.3 11.1% 1 39.07s 6,948 1,166 55,883
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

Vergelijkingspaar wisselen