Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

KAT Coder AIR V2.5 (high) vs GPT-5.6 Luna

GPT-5.6 Luna führt beim Durchschnittsscore mit 5.3 vs 5.2. GPT-5.6 Luna hat die niedrigeren Benchmark-Kosten mit $0.042 vs $0.077. GPT-5.6 Luna ist schneller mit 3.78s vs 15.23s, mit Erfolgsraten von 40.6% vs 34.8%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-07

Verglichene Modelle

Rang
#306
Gesamte Ausgabe-Token
114,654
Antwortzeit (Durchschnitt)
15.23s
Gesamtkosten
$0.077
Rang
#297
Gesamte Ausgabe-Token
8,000
Antwortzeit (Durchschnitt)
3.78s
Gesamtkosten
$0.042
Empfohlenes Modell GPT-5.6 Luna

Es hat hier die beste Punktzahl (5.3) und kostet etwa 1.8x weniger als KAT Coder AIR V2.5 (high).

Detaillierter Vergleich

Metrik KAT Coder AIR V2.5 KAT Coder AIR V2.5 high Veröffentlichung: 2026-07-14 GPT-5.6 Luna GPT-5.6 Luna none Veröffentlichung: 2026-07-09
Punktzahl 5.2 5.3
Rang #306 #297
Zuverlässigkeit 9.8 10.0
Konsistenz 8.2 8.8
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 40.6% 34.8%
Instabile Tests 5 3
Gesamtläufe 69 69
Kosten pro Ergebnis 1.091 2.814
Gesamtkosten $0.077 $0.042
Eingabepreis $0.150 / 1M $0.200 / 1M
Ausgabepreis $0.600 / 1M $1.200 / 1M
Preis für Cache-Lesen k. A. $0.020 / 1M
Preis für Cache-Schreiben k. A. $0.250 / 1M
Gesamte Eingabe-Token 50,423 230,744
Ausgabe-Token 4,144 8,000
Denk-Token 110,510 0
Antwortzeit (Durchschnitt) 15.23s 3.78s
Antwortzeit (Maximum) 118.35s 53.77s
Antwortzeit (Gesamt) 350.26s 86.83s
Parameter ~35B insgesamt (~3B aktiv) ~400B insgesamt (~17B aktiv)
Verfügbarkeit Geschlossen Geschlossen

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#306 KAT Coder AIR V2.5

high
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Zeit
300.0s
Token
0 tok

#297 GPT-5.6 Luna

none
Kosten
$0.016
Zeit
15.8s
Token
2,685 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
KAT Coder AIR V2.5 4.3 7.3 11.1% 1 39.07s 6,948 1,166 55,883
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

Vergleichspaar wechseln