Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 27B (low) vs GLM 5 (medium)

Qwen3.8 27B (low) leidt in gemiddelde score met 7.9 vs 7.7. Qwen3.8 27B (low) heeft lagere benchmarkkosten met ~$0.071 vs $0.228. GLM 5 (medium) is sneller met 33.54s vs 39.11s, met slagingspercentages van 68.2% vs 78.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-08-20

Rang
#61
Totaal aantal uitvoer-tokens
169,329
Responstijd (gem.)
39.11s
Totale kosten
~$0.071
Rang
#72
Totaal aantal uitvoer-tokens
124,566
Responstijd (gem.)
33.54s
Totale kosten
$0.228
Aanbevolen model Qwen3.8 27B (low)

Het heeft hier de beste score (7.9) en kost ongeveer 3.2x minder dan GLM 5 (medium).

Gedetailleerde vergelijking

Metriek Qwen3.8 27B Qwen3.8 27B low Releasedatum: 2026-08-14 GLM 5 GLM 5 medium Releasedatum: 2026-02-12
Score 7.9 7.7
Rang #61 #72
Betrouwbaarheid 10.0 10.0
Consistentie 10.0 8.1
Pogingen 66/66 63/66
Correcte tests
Slaagpercentage per poging 68.2% 78.8%
Instabiele tests 0 4
Totaal runs 66 63
Kosten per resultaat ~0.473 1.668
Totale kosten ~$0.071 $0.228
Invoerprijs n.v.t. $0.600 / 1M
Uitvoerprijs n.v.t. $1.920 / 1M
Totaal aantal invoer-tokens 99,705 35,224
Uitvoer-tokens 1,545 21,570
Redeneer-tokens 167,784 102,996
Responstijd (gem.) 39.11s 33.54s
Responstijd (max) 376.04s 99.85s
Responstijd (totaal) 860.51s 435.99s
Parameters 27.3B 744B totaal (40B actief)
Beschikbaarheid Gewichten beschikbaar Open-source

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#61 Qwen3.8 27B

low
Kosten
~$0.003
Tijd
92.8s
Tokens
6,902 tok

#72 GLM 5

medium
Kosten
$0.005
Tijd
20.7s
Tokens
2,068 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

Snelle vergelijking

Vergelijkingspaar wisselen

Seed-2.0-CodelowvsGLM 5mediumQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowQwen3.7 FlashhighvsGLM 5mediumClaude Opus 4.8lowvsGLM 5mediumGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumDeepSeek V4 ProhighvsGLM 5mediumGPT-5.6 TerramediumvsQwen3.8 27Blow