Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 27B (low) vs GLM 5.2 (medium)

Qwen3.8 27B (low) leidt in gemiddelde score met 7.9 vs 7.8. Qwen3.8 27B (low) heeft lagere benchmarkkosten met ~$0.071 vs $0.151. GLM 5.2 (medium) is sneller met 23.28s vs 39.11s, met slagingspercentages van 68.2% vs 80.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-28

Vergeleken modellen

Rang
#93
Totaal aantal uitvoer-tokens
169,329
Responstijd (gem.)
39.11s
Totale kosten
~$0.071
Rang
#98
Totaal aantal uitvoer-tokens
61,761
Responstijd (gem.)
23.28s
Totale kosten
$0.151
Aanbevolen model Qwen3.8 27B (low)

Het heeft hier de beste score (7.9) en kost ongeveer 2.1x minder dan GLM 5.2 (medium).

Gedetailleerde vergelijking

Metriek Qwen3.8 27B Qwen3.8 27B low Releasedatum: 2026-08-14 GLM 5.2 GLM 5.2 medium Releasedatum: 2026-06-17
Score 7.9 7.8
Rang #93 #98
Betrouwbaarheid 10.0 9.5
Consistentie 10.0 8.0
Pogingen 66/66 63/66
Correcte tests
Slaagpercentage per poging 68.2% 80.3%
Instabiele tests 0 4
Totaal runs 66 63
Kosten per resultaat ~0.473 2.159
Totale kosten ~$0.071 $0.151
Invoerprijs n.v.t. $0.650 / 1M
Uitvoerprijs n.v.t. $2.042 / 1M
Totaal aantal invoer-tokens 99,705 37,199
Uitvoer-tokens 1,545 12,261
Redeneer-tokens 167,784 49,500
Responstijd (gem.) 39.11s 23.28s
Responstijd (max) 376.04s 101.36s
Responstijd (totaal) 860.51s 488.94s
Parameters 27.3B 744B totaal (40B actief)
Beschikbaarheid Gewichten beschikbaar Open-source

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Qwen3.8 27B

low
Kosten
~$0.003
Tijd
92.8s
Tokens
6,902 tok

#98 GLM 5.2

medium
Kosten
$0.041
Tijd
195.8s
Tokens
9,287 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

Snelle vergelijking

Vergelijkingspaar wisselen

Qwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowGPT-6 LunamediumvsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Sonnet 4.6mediumvsQwen3.8 27BlowGPT-5.2 ChatnonevsGLM 5.2mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2medium