Navigatie
Advertise here

Command A+ (high) vs Tev1 4B Experimental

Command A+ (high) leidt in gemiddelde score met 3.2 vs 1.0. Tev1 4B Experimental heeft lagere benchmarkkosten met $0.002 vs $0.079. Tev1 4B Experimental is sneller met 498ms vs 89.96s, met slagingspercentages van 0.0% vs 13.0%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-01

Vergeleken modellen

Rang
#368
Totaal aantal uitvoer-tokens
28,663
Responstijd (gem.)
89.96s
Totale kosten
$0.079
Rang
#381
Totaal aantal uitvoer-tokens
96
Responstijd (gem.)
498ms
Totale kosten
$0.002
Aanbevolen model Command A+ (high)

Het heeft de sterkste score in deze vergelijking (3.2) en de beste balans tussen kosten en responstijd over alle 2 modellen.

Gedetailleerde vergelijking

Metriek Command A+ Command A+ high Releasedatum: 2026-09-23 Tev1 4B Experimental Tev1 4B Experimental none Releasedatum: 2026-09-30
Score 3.2 1.0
Rang #368 #381
Betrouwbaarheid 3.5 10.0
Consistentie 10.0 3.0
Pogingen 69/69 21/69
Correcte tests
Slaagpercentage per poging 0.0% 13.0%
Instabiele tests 0 0
Totaal runs 69 21
Kosten per resultaat 0.000 0.048
Totale kosten $0.079 $0.002
Invoerprijs $0.300 / 1M $0.042 / 1M
Uitvoerprijs $1.500 / 1M $0.000 / 1M
Prijs voor cachelezen $0.150 / 1M n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 117,966 33,864
Uitvoer-tokens 5,149 96
Redeneer-tokens 23,514 0
Responstijd (gem.) 89.96s 498ms
Responstijd (max) 156.00s 602ms
Responstijd (totaal) 2069.01s 3.49s
Parameters 218B totaal (25B actief) 4B
Beschikbaarheid Open-source Gewichten beschikbaar

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#368 Command A+

high
Provider returned error
Kosten
$0.000
Tijd
0.2s
Tokens
0 tok

#381 Together: Tev1 4B Experimental

none
Er is nog geen showcase-resultaat gegenereerd voor dit model.
Kosten
n.v.t.
Tijd
-
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Command A+ 3.0 10.0 0.0% 0 92.74s 0 0 0
Tev1 4B Experimental 0.0 0.0 0.0% 0 0ms 0 0 0

Snelle vergelijking

Vergelijkingspaar wisselen