Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Command A+ vs Decider V1.1 27B (default)

Command A+ leidt in gemiddelde score met 3.0 vs 2.6. Command A+ heeft lagere benchmarkkosten met $0.000 vs $0.002. Decider V1.1 27B (default) is sneller met 320ms vs 77.87s, met slagingspercentages van 0.0% vs 17.4%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#390
Totaal aantal uitvoer-tokens
0
Responstijd (gem.)
77.87s
Totale kosten
$0.000
Rang
#395
Totaal aantal uitvoer-tokens
69
Responstijd (gem.)
320ms
Totale kosten
$0.002
Aanbevolen model Decider V1.1 27B (default)

De score blijft dicht bij de beste score hier (2.6 vs 3.0) en het reageert ongeveer 243.3x sneller dan Command A+.

Gedetailleerde vergelijking

Metriek Command A+ Command A+ none Releasedatum: 2026-09-23 Decider V1.1 27B Decider V1.1 27B default Releasedatum: 2026-10-07
Score 3.0 2.6
Rang #390 #395
Betrouwbaarheid 0.0 10.0
Consistentie 10.0 5.2
Pogingen 69/69 36/69
Correcte tests
Slaagpercentage per poging 0.0% 17.4%
Instabiele tests 0 0
Totaal runs 69 36
Kosten per resultaat 0.000 0.037
Totale kosten $0.000 $0.002
Invoerprijs $0.300 / 1M $0.020 / 1M
Uitvoerprijs $1.500 / 1M $0.000 / 1M
Prijs voor cachelezen $0.150 / 1M n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 0 73,557
Uitvoer-tokens 0 69
Redeneer-tokens 0 0
Responstijd (gem.) 77.87s 320ms
Responstijd (max) 106.37s 491ms
Responstijd (totaal) 1791.03s 3.84s
Parameters 218B totaal (25B actief) 27B
Beschikbaarheid Open-source Open-source

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#390 Command A+

none
Provider returned error
Kosten
$0.000
Tijd
0.2s
Tokens
0 tok

#395 Decider V1.1 27B

default
Er is nog geen showcase-resultaat gegenereerd voor dit model.
Kosten
n.v.t.
Tijd
-
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Command A+ 3.0 10.0 0.0% 0 80.82s 0 0 0
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

Vergelijkingspaar wisselen

Command A+nonevsJev 1.13defaultCommand A+lowvsDecider V1.1 27BdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultCommand A+nonevsKev 4BdefaultCommand A+highvsDecider V1.1 27BdefaultCommand A+nonevsLing 3.0 TinymediumCommand A+nonevsLing 3.0 TinylowCommand A+nonevsLing 3.0 TinyhighGemini 3 Flash PreviewhighvsDecider V1.1 27BdefaultCommand A+nonevsGranite 4.1 8bdefaultCommand A+mediumvsDecider V1.1 27BdefaultDecider V1.1 27BdefaultvsGrok 4.20none