Navigatie
Advertise here

Qwen3.8 27B (medium) vs GLM 5.3 Flash (high)

GLM 5.3 Flash (high) leidt in gemiddelde score met 7.3 vs 7.2. GLM 5.3 Flash (high) heeft lagere benchmarkkosten met $0.056 vs ~$0.073. GLM 5.3 Flash (high) is sneller met 29.11s vs 40.09s, met slagingspercentages van 66.7% vs 66.7%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-03

Vergeleken modellen

Rang
#143
Totaal aantal uitvoer-tokens
170,696
Responstijd (gem.)
40.09s
Totale kosten
~$0.073
Rang
#134
Totaal aantal uitvoer-tokens
99,340
Responstijd (gem.)
29.11s
Totale kosten
$0.056
Aanbevolen model GLM 5.3 Flash (high)

Het heeft de sterkste score in deze vergelijking (7.3) en de beste balans tussen kosten en responstijd over alle 2 modellen.

Gedetailleerde vergelijking

Metriek Qwen3.8 27B Qwen3.8 27B medium Releasedatum: 2026-08-14 Gratis beschikbaar GLM 5.3 Flash GLM 5.3 Flash high Releasedatum: 2026-08-26
Score 7.2 7.3
Rang #143 #134
Betrouwbaarheid 9.7 10.0
Consistentie 9.4 8.6
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 66.7% 66.7%
Instabiele tests 2 4
Totaal runs 69 69
Kosten per resultaat ~0.520 0.426
Totale kosten ~$0.073 $0.056
Invoerprijs n.v.t. $0.150 / 1M
Uitvoerprijs n.v.t. $0.500 / 1M
Prijs voor cachelezen n.v.t. $0.030 / 1M
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 277,164 225,013
Uitvoer-tokens 1,913 12,197
Redeneer-tokens 168,783 87,143
Responstijd (gem.) 40.09s 29.11s
Responstijd (max) 214.63s 163.41s
Responstijd (totaal) 881.89s 669.54s
Parameters 27.3B 320B totaal (18B actief)
Beschikbaarheid Gewichten beschikbaar Open-source

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#143 Qwen3.8 27B

medium
Kosten
~$0.002
Tijd
43.4s
Tokens
2,956 tok

#134 GLM 5.3 Flash

high
Kosten
$0.003
Tijd
186.7s
Tokens
10,486 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
GLM 5.3 Flash 8.2 7.2 88.9% 1 19.62s 7,317 373 9,973

Snelle vergelijking

Vergelijkingspaar wisselen