Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna Decisions (default) vs Tev1 4B Experimental (default)

GPT-6 Luna Decisions (default) leidt in gemiddelde score met 2.4 vs 1.0. Tev1 4B Experimental (default) heeft lagere benchmarkkosten met $0.002 vs $0.005. GPT-6 Luna Decisions (default) is sneller met 495ms vs 498ms, met slagingspercentages van 13.0% vs 13.0%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#390
Totaal aantal uitvoer-tokens
0
Responstijd (gem.)
495ms
Totale kosten
$0.005
Rang
#397
Totaal aantal uitvoer-tokens
96
Responstijd (gem.)
498ms
Totale kosten
$0.002
Aanbevolen model GPT-6 Luna Decisions (default)

Het heeft de sterkste score in deze vergelijking (2.4) en de beste balans tussen kosten en responstijd over alle 2 modellen.

Gedetailleerde vergelijking

Metriek GPT-6 Luna Decisions GPT-6 Luna Decisions default Releasedatum: 2026-10-07 Tev1 4B Experimental Tev1 4B Experimental default Releasedatum: 2026-09-30
Score 2.4 1.0
Rang #390 #397
Betrouwbaarheid 10.0 10.0
Consistentie 5.2 3.0
Pogingen 36/69 21/69
Correcte tests
Slaagpercentage per poging 13.0% 13.0%
Instabiele tests 0 0
Totaal runs 36 21
Kosten per resultaat 0.159 0.048
Totale kosten $0.005 $0.002
Invoerprijs $0.100 / 1M $0.042 / 1M
Uitvoerprijs $0.000 / 1M $0.000 / 1M
Prijs voor cachelezen $0.000 / 1M n.v.t.
Prijs voor cacheschrijven $0.000 / 1M n.v.t.
Totaal aantal invoer-tokens 47,583 33,864
Uitvoer-tokens 0 96
Redeneer-tokens 0 0
Responstijd (gem.) 495ms 498ms
Responstijd (max) 842ms 602ms
Responstijd (totaal) 5.94s 3.49s
Parameters ~400B totaal (~17B actief) 4B
Beschikbaarheid Gesloten broncode Gewichten beschikbaar

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Tev1 4B Experimental 0.0 0.0 0.0% 0 0ms 0 0 0

Snelle vergelijking

Vergelijkingspaar wisselen

Command A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsTev1 4B ExperimentaldefaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20noneLing 3.0 TinymediumvsGPT-6 Luna DecisionsdefaultLing 3.0 TinylowvsGPT-6 Luna DecisionsdefaultLing 3.0 TinyhighvsGPT-6 Luna DecisionsdefaultNemotron 3.5 LightningnoneGratis beschikbaarvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsQwen3.5-9Bmedium