Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 (medium) vs GLM 5.1

GLM 5.1 leidt in gemiddelde score met 6.5 vs 6.4. GLM 5.1 heeft lagere benchmarkkosten met $0.451 vs $0.841. GLM 5.1 is sneller met 11.10s vs 125.76s, met slagingspercentages van 60.9% vs 47.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-05

Vergeleken modellen

Rang
#211
Totaal aantal uitvoer-tokens
241,096
Responstijd (gem.)
125.76s
Totale kosten
$0.841
Rang
#203
Totaal aantal uitvoer-tokens
20,076
Responstijd (gem.)
11.10s
Totale kosten
$0.451
Aanbevolen model GLM 5.1

Het heeft hier de beste score (6.5) en kost ongeveer 1.9x minder dan Kimi K2.5 (medium).

Gedetailleerde vergelijking

Metriek Kimi K2.5 Kimi K2.5 medium Releasedatum: 2026-01-27 GLM 5.1 GLM 5.1 none Releasedatum: 2026-04-07
Score 6.4 6.5
Rang #211 #203
Betrouwbaarheid 9.6 10.0
Consistentie 7.1 8.2
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 60.9% 47.8%
Instabiele tests 8 5
Totaal runs 69 69
Kosten per resultaat 6.085 3.478
Totale kosten $0.841 $0.451
Invoerprijs $0.450 / 1M $1.400 / 1M
Uitvoerprijs $2.250 / 1M $4.400 / 1M
Prijs voor cachelezen $0.070 / 1M $0.260 / 1M
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 292,271 258,956
Uitvoer-tokens 55,025 20,076
Redeneer-tokens 186,071 0
Responstijd (gem.) 125.76s 11.10s
Responstijd (max) 566.79s 107.19s
Responstijd (totaal) 2137.84s 255.39s
Parameters 1T totaal (32B actief) 744B totaal (40B actief)
Beschikbaarheid Gewichten beschikbaar Open-source

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#211 MoonshotAI: Kimi K2.5

medium
Kosten
$0.030
Tijd
58.6s
Tokens
8,683 tok

#203 GLM 5.1

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
300.0s
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

Snelle vergelijking

Vergelijkingspaar wisselen