Navigatie
Advertise here

Muse Glimmer 30B (low) vs GPT-5.6 Luna (low)

Muse Glimmer 30B (low) leidt in gemiddelde score met 6.9 vs 6.9. GPT-5.6 Luna (low) heeft lagere benchmarkkosten met $0.049 vs $0.219. GPT-5.6 Luna (low) is sneller met 6.96s vs 22.40s, met slagingspercentages van 63.8% vs 56.5%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#172
Totaal aantal uitvoer-tokens
105,320
Responstijd (gem.)
22.40s
Totale kosten
$0.219
Rang
#176
Totaal aantal uitvoer-tokens
28,001
Responstijd (gem.)
6.96s
Totale kosten
$0.049
Aanbevolen model GPT-5.6 Luna (low)

De score blijft dicht bij de beste score hier (6.9 vs 6.9) en het kost ongeveer 4.5x minder dan Muse Glimmer 30B (low).

Gedetailleerde vergelijking

Metriek Muse Glimmer 30B Muse Glimmer 30B low Releasedatum: 2026-08-11 GPT-5.6 Luna GPT-5.6 Luna low Releasedatum: 2026-07-09
Score 6.9 6.9
Rang #172 #176
Betrouwbaarheid 10.0 10.0
Consistentie 8.0 8.3
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 63.8% 56.5%
Instabiele tests 6 5
Totaal runs 69 69
Kosten per resultaat 2.414 2.428
Totale kosten $0.219 $0.049
Invoerprijs $0.300 / 1M $0.200 / 1M
Uitvoerprijs $1.200 / 1M $1.200 / 1M
Prijs voor cachelezen $0.040 / 1M $0.020 / 1M
Prijs voor cacheschrijven n.v.t. $0.250 / 1M
Totaal aantal invoer-tokens 307,228 202,680
Uitvoer-tokens 36,044 9,230
Redeneer-tokens 71,621 18,771
Responstijd (gem.) 22.40s 6.96s
Responstijd (max) 234.92s 45.74s
Responstijd (totaal) 515.14s 160.19s
Parameters 30B ~400B totaal (~17B actief)
Beschikbaarheid Open-source Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#172 Muse Glimmer 30B

low
Kosten
$0.002
Tijd
13.5s
Tokens
953 tok

#176 GPT-5.6 Luna

low
Kosten
$0.011
Tijd
10.2s
Tokens
1,897 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Muse Glimmer 30B 8.1 9.9 66.7% 0 16.52s 7,419 2,759 10,173
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

Vergelijkingspaar wisselen