Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 2.4T A95B (high) vs GLM 5.3 (high)

De gemiddelde score is vrijwel gelijk met 7.9 vs 7.8. GLM 5.3 (high) heeft lagere benchmarkkosten met $0.610 vs $2.949. GLM 5.3 (high) is sneller met 28.38s vs 120.88s, met slagingspercentages van 75.4% vs 75.4%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-03

Vergeleken modellen

Rang
#103
Totaal aantal uitvoer-tokens
468,439
Responstijd (gem.)
120.88s
Totale kosten
$2.949
Rang
#107
Totaal aantal uitvoer-tokens
68,482
Responstijd (gem.)
28.38s
Totale kosten
$0.610
Aanbevolen model GLM 5.3 (high)

Het heeft hier de beste score (7.8) en kost ongeveer 4.8x minder dan Qwen3.8 2.4T A95B (high).

Gedetailleerde vergelijking

Metriek Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B high Releasedatum: 2026-08-12 GLM 5.3 GLM 5.3 high Releasedatum: 2026-08-20
Score 7.9 7.8
Rang #103 #107
Betrouwbaarheid 9.6 10.0
Consistentie 8.4 7.6
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 75.4% 75.4%
Instabiele tests 4 7
Totaal runs 69 69
Kosten per resultaat 18.696 4.351
Totale kosten $2.949 $0.610
Invoerprijs $2.000 / 1M $1.400 / 1M
Uitvoerprijs $6.000 / 1M $4.400 / 1M
Prijs voor cachelezen $0.250 / 1M $0.140 / 1M
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 295,642 219,811
Uitvoer-tokens 115,041 8,811
Redeneer-tokens 353,398 59,671
Responstijd (gem.) 120.88s 28.38s
Responstijd (max) 532.28s 159.91s
Responstijd (totaal) 2780.16s 652.78s
Parameters 2.4T totaal (95B actief) 744B totaal (40B actief)
Beschikbaarheid Gewichten beschikbaar Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#103 Qwen3.8 2.4T A95B

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
600.0s
Tokens
0 tok

#107 GLM 5.3

high
Kosten
$0.085
Tijd
362.5s
Tokens
19,310 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.8 2.4T A95B 5.9 6.3 55.6% 1 160.52s 6,399 3,310 48,078
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

Snelle vergelijking

Vergelijkingspaar wisselen