Navigatie
AI BENCHY
Advertise here

Vergeleken modellen

Benchmarkvergelijking GLM 5.3 Flash (max) vs DeepSeek V4 Flash 0731 (high) vs Qwen3.8 27B (high) vs GLM 5.3 (high): GLM 5.3 Flash (max) leidt op Score met 8.7. GLM 5.3 Flash (max) leidt op Betrouwbaarheid met 10.0. DeepSeek V4 Flash 0731 (high) heeft de laagste Totale kosten met $0.058. GLM 5.3 (high) is het snelst met 27.82s.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-08-26

Rang
#29
Totaal aantal uitvoer-tokens
204,340
Responstijd (gem.)
52.10s
Totale kosten
$0.059
Rang
#55
Totaal aantal uitvoer-tokens
513,307
Responstijd (gem.)
114.94s
Totale kosten
$0.058
Rang
#43
Totaal aantal uitvoer-tokens
656,635
Responstijd (gem.)
167.89s
Totale kosten
~$0.287
Rang
#100
Totaal aantal uitvoer-tokens
63,667
Responstijd (gem.)
27.82s
Totale kosten
$0.403
Aanbevolen model GLM 5.3 Flash (max)

Het heeft hier de beste score (8.7) en kost ongeveer 4.3x minder dan de andere modellen in deze vergelijking.

Gedetailleerde vergelijking

Metriek GLM 5.3 Flash GLM 5.3 Flash max Releasedatum: 2026-08-26 DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 high Releasedatum: 2026-08-01 Qwen3.8 27B Qwen3.8 27B high Releasedatum: 2026-08-14 GLM 5.3 GLM 5.3 high Releasedatum: 2026-08-20
Score 8.7 8.0 8.4 7.3
Rang #29 #55 #43 #100
Betrouwbaarheid 10.0 10.0 9.6 10.0
Consistentie 8.9 8.0 9.2 7.5
Pogingen 66/66 66/66 66/66 66/66
Correcte tests
Slaagpercentage per poging 81.8% 75.8% 77.3% 74.2%
Instabiele tests 3 5 2 7
Totaal runs 66 66 66 66
Kosten per resultaat 0.365 0.956 ~1.792 3.099
Totale kosten $0.059 $0.058 ~$0.287 $0.403
Invoerprijs $0.075 / 1M $0.060 / 1M n.v.t. $1.400 / 1M
Uitvoerprijs $0.250 / 1M $0.120 / 1M n.v.t. $4.400 / 1M
Totaal aantal invoer-tokens 96,873 96,702 100,179 87,601
Uitvoer-tokens 7,637 16,966 904 6,006
Redeneer-tokens 196,703 496,341 655,731 57,661
Responstijd (gem.) 52.10s 114.94s 167.89s 27.82s
Responstijd (max) 333.47s 600.61s 640.85s 159.91s
Responstijd (totaal) 1146.24s 2528.65s 3693.54s 612.06s
Parameters 320B totaal (18B actief) 284B totaal (13B actief) 27.3B 744B totaal (40B actief)
Beschikbaarheid Open-source Gesloten broncode Gewichten beschikbaar Gesloten broncode

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 GLM 5.3 Flash

max
Kosten
$0.005
Tijd
296.5s
Tokens
16,250 tok

#55 DeepSeek V4 Flash 0731

high
Ongeldige SVG
Kosten
$0.000
Tijd
187.3s
Tokens
19,048 tok

#43 Qwen3.8 27B

high
Kosten
~$0.008
Tijd
270.1s
Tokens
18,963 tok

#100 GLM 5.3

high
Kosten
$0.085
Tijd
362.5s
Tokens
19,310 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GLM 5.3 Flash 10.0 10.0 100.0% 0 43.37s 7,317 381 23,692
DeepSeek V4 Flash 0731 6.3 6.3 55.6% 1 252.67s 7,044 2,160 191,210
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

Snelle vergelijking

Vergelijkingspaar wisselen