Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Command A+ vs gpt-oss-120b

gpt-oss-120b leidt in gemiddelde score met 3.7 vs 3.0. Command A+ heeft lagere benchmarkkosten met $0.000 vs $0.033. gpt-oss-120b is sneller met 21.61s vs 81.36s, met slagingspercentages van 0.0% vs 33.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-23

Vergeleken modellen

Rang
#356
Totaal aantal uitvoer-tokens
0
Responstijd (gem.)
81.36s
Totale kosten
$0.000
Rang
#349
Totaal aantal uitvoer-tokens
51,664
Responstijd (gem.)
21.61s
Totale kosten
$0.033
Aanbevolen model gpt-oss-120b

Het heeft hier de beste score (3.7) en reageert ongeveer 3.8x sneller dan Command A+.

Gedetailleerde vergelijking

Metriek Command A+ Command A+ none Releasedatum: 2026-09-23 gpt-oss-120b gpt-oss-120b none Releasedatum: 2025-08-05 Gratis beschikbaar
Score 3.0 3.7
Rang #356 #349
Betrouwbaarheid 0.0 10.0
Consistentie 10.0 7.8
Pogingen 66/66 57/66
Correcte tests
Slaagpercentage per poging 0.0% 33.3%
Instabiele tests 0 2
Totaal runs 66 57
Kosten per resultaat 0.000 0.168
Totale kosten $0.000 $0.033
Invoerprijs $0.300 / 1M $0.150 / 1M
Uitvoerprijs $1.500 / 1M $0.600 / 1M
Totaal aantal invoer-tokens 0 9,081
Uitvoer-tokens 0 51,664
Redeneer-tokens 0 0
Responstijd (gem.) 81.36s 21.61s
Responstijd (max) 106.37s 113.71s
Responstijd (totaal) 1789.98s 345.79s
Parameters 218B totaal (25B actief) 117B totaal (5.1B actief)
Beschikbaarheid Open-source Open-source

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#356 Command A+

none
Provider returned error
Kosten
$0.000
Tijd
0.2s
Tokens
0 tok

#349 gpt-oss-120b

none
Er is nog geen showcase-resultaat gegenereerd voor dit model.
Kosten
n.v.t.
Tijd
-
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Command A+ 3.0 10.0 0.0% 0 80.82s 0 0 0
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0

Snelle vergelijking

Vergelijkingspaar wisselen