Navigatie
AI BENCHY
Vergelijken Grafieken Methodologie
โค๏ธ Made by XCS
Your ad here

AI BENCHY Compare

StepFun: Step 3.5 Flash vs Z.ai: GLM 5

Vergelijken:

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-03-06

Metriek StepFun: Step 3.5 Flash medium Releasedatum: 2026-02-01 Gratis beschikbaar Z.ai: GLM 5 medium Releasedatum: 2026-02-12
Rang #13 #14
Gem. score 7.4 7.4
Consistentie 9.1 8.0
Kosten per resultaat 0.000 0.933
Totale kosten $0.000 $0.103
Correcte tests
Slaagpercentage per poging 68.8% 83.3%
Instabiele tests 2 4
Totaal runs 48 (16 x 3) 48 (16 x 3)
Uitvoer-tokens 71,452 19,773
Redeneer-tokens 155,147 36,459
Responstijd (gem.) 29.10s 16.16s
Responstijd (max) 170.45s 28.96s
Responstijd (totaal) 290.96s 129.26s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Gem. score vs Responstijd (gem.)

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
StepFun: Step 3.5 Flash 10.0 10.0 100.0% 0 18.54s 13,924 17,208
Z.ai: GLM 5 10.0 10.0 100.0% 0 22.26s 420 4,992
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
StepFun: Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 1,176 12,984
Z.ai: GLM 5 10.0 10.0 100.0% 0 28.96s 662 3,242
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
StepFun: Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 600 13,886
Z.ai: GLM 5 5.0 5.6 83.3% 1 8.90s 567 3,734
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
StepFun: Step 3.5 Flash 4.0 7.2 44.4% 1 170.45s 45,350 90,436
Z.ai: GLM 5 10.0 4.4 33.3% 2 0ms 13,176 14,137
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
StepFun: Step 3.5 Flash 6.0 10.0 0.0% 0 6.54s 2,214 2,584
Z.ai: GLM 5 5.0 3.1 66.7% 1 14.69s 2,020 2,248
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
StepFun: Step 3.5 Flash 9.0 6.8 83.3% 1 4.98s 2,284 3,412
Z.ai: GLM 5 10.0 10.0 100.0% 0 7.25s 1,001 2,129
Puzzle Solving Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
StepFun: Step 3.5 Flash 4.0 10.0 33.3% 0 7.72s 5,629 10,835
Z.ai: GLM 5 10.0 10.0 100.0% 0 15.64s 1,694 4,983
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
StepFun: Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 275 3,802
Z.ai: GLM 5 10.0 10.0 100.0% 0 15.93s 233 994

Snelle vergelijking

Vergelijkingspaar wisselen