Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.7 (low) vs GLM 5.1 (medium)

GLM 5.1 (medium) leidt in gemiddelde score met 7.5 vs 7.4. GLM 5.1 (medium) heeft lagere benchmarkkosten met $1.066 vs $2.263. Grok 4.7 (low) is sneller met 63.19s vs 66.38s, met slagingspercentages van 73.9% vs 66.7%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-01

Vergeleken modellen

Rang
#127
Totaal aantal uitvoer-tokens
255,329
Responstijd (gem.)
63.19s
Totale kosten
$2.263
Rang
#119
Totaal aantal uitvoer-tokens
248,708
Responstijd (gem.)
66.38s
Totale kosten
$1.066
Aanbevolen model GLM 5.1 (medium)

Het heeft hier de beste score (7.5) en kost ongeveer 2.1x minder dan Grok 4.7 (low).

Gedetailleerde vergelijking

Metriek Grok 4.7 Grok 4.7 low Releasedatum: 2026-09-21 GLM 5.1 GLM 5.1 medium Releasedatum: 2026-04-07
Score 7.4 7.5
Rang #127 #119
Betrouwbaarheid 10.0 9.2
Consistentie 8.3 8.4
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 73.9% 66.7%
Instabiele tests 5 4
Totaal runs 69 69
Kosten per resultaat 13.804 9.004
Totale kosten $2.263 $1.066
Invoerprijs $2.000 / 1M $0.965 / 1M
Uitvoerprijs $6.000 / 1M $3.032 / 1M
Totaal aantal invoer-tokens 365,119 331,577
Uitvoer-tokens 8,118 17,919
Redeneer-tokens 247,211 230,789
Responstijd (gem.) 63.19s 66.38s
Responstijd (max) 389.63s 308.75s
Responstijd (totaal) 1453.28s 1460.31s
Parameters ~1.7T totaal (~170B actief) 744B totaal (40B actief)
Beschikbaarheid Gesloten broncode Open-source

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#127 SpaceXAI: Grok 4.7

low
Kosten
$0.007
Tijd
15.2s
Tokens
1,537 tok

#119 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
300.0s
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

Snelle vergelijking

Vergelijkingspaar wisselen