Benchmarkvergelijking Qwen3.5 Plus 2026-02-15 vs Qwen3.6 Plus Preview vs GLM 5 TurboGLM 5 Turbo leidt op Score met 8.4. Qwen3.5 Plus 2026-02-15 leidt op Betrouwbaarheid met 10.0. Qwen3.6 Plus Preview heeft de laagste Totale kosten met $0.000. Qwen3.6 Plus Preview is het snelst met 15.25s.
Aanbevolen model: GLM 5 Turbo - Het heeft hier de beste score (8.4) en reageert ongeveer 1.9x sneller dan de andere modellen in deze vergelijking.
Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-18
Qwen3.6 Plus PreviewQwen3.6 Plus PreviewmediumGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-04-20Gratis beschikbaar
GLM 5 TurboGLM 5 TurbomediumGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-03-15
Qwen3.6 Plus PreviewQwen3.6 Plus PreviewmediumGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-04-20Gratis beschikbaar
GLM 5 TurboGLM 5 TurbomediumGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-03-15
Score
8.0Gemiddelde score over alle benchmarktests.โฆ
5.8Gemiddelde score over alle benchmarktests.โฆ
8.4Gemiddelde score over alle benchmarktests.โฆ
Rang
#28
#113
#21
Betrouwbaarheid
10.0Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vรณรณr succesvolle calls; geregistreerde fouten verlagen de score.โฆ
n.v.t.Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vรณรณr succesvolle calls; geregistreerde fouten verlagen de score.โฆ
10.0Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vรณรณr succesvolle calls; geregistreerde fouten verlagen de score.โฆ
Consistentie
8.8Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
9.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
8.5Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
Correcte tests
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 4Time-out: 2API-fout: 1Responstijd (gem.)73.79sResponstijd (max)266.69sResponstijd (totaal)1033.07sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 8Verkeerd antwoord: 2Responstijd (gem.)15.25sResponstijd (max)43.55sResponstijd (totaal)182.96sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
7.9Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
83.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
1Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)45.78sResponstijd (max)81.20sResponstijd (totaal)91.57sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
45.78sResponstijd (gem.)โฆ
672Totaal aantal invoer-tokensโฆ
205Uitvoer-tokensโฆ
21,236Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
8.3Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
75.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)11.69sResponstijd (max)19.37sResponstijd (totaal)35.08sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
11.69sResponstijd (gem.)โฆ
501Totaal aantal invoer-tokensโฆ
61Uitvoer-tokensโฆ
5,812Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)4.82sResponstijd (max)7.69sResponstijd (totaal)19.26sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
7.1Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
44.4%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
1Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Verkeerd antwoord: 1Responstijd (gem.)180.70sResponstijd (max)266.69sResponstijd (totaal)542.10sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
180.70sResponstijd (gem.)โฆ
6,950Totaal aantal invoer-tokensโฆ
420Uitvoer-tokensโฆ
80,595Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
9.8Gemiddelde score over alle benchmarktests.โฆ
3.3Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)0msResponstijd (max)0msResponstijd (totaal)0msEen test is alleen volledig geslaagd als alle runs slagen.โฆ
0msResponstijd (gem.)โฆ
0Totaal aantal invoer-tokensโฆ
0Uitvoer-tokensโฆ
0Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
8.2Gemiddelde score over alle benchmarktests.โฆ
9.3Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen antwoord: 1Responstijd (gem.)45.90sResponstijd (max)95.57sResponstijd (totaal)137.71sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)46.85sResponstijd (max)46.85sResponstijd (totaal)46.85sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
46.85sResponstijd (gem.)โฆ
14,934Totaal aantal invoer-tokensโฆ
421Uitvoer-tokensโฆ
7,906Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)34.95sResponstijd (max)34.95sResponstijd (totaal)34.95sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
34.95sResponstijd (gem.)โฆ
14,934Totaal aantal invoer-tokensโฆ
452Uitvoer-tokensโฆ
13,073Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)13.88sResponstijd (max)13.88sResponstijd (totaal)13.88sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)46.91sResponstijd (max)46.91sResponstijd (totaal)46.91sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
46.91sResponstijd (gem.)โฆ
7,782Totaal aantal invoer-tokensโฆ
270Uitvoer-tokensโฆ
14,916Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)14.95sResponstijd (max)15.40sResponstijd (totaal)29.90sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
14.95sResponstijd (gem.)โฆ
7,782Totaal aantal invoer-tokensโฆ
270Uitvoer-tokensโฆ
10,706Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)6.19sResponstijd (max)6.42sResponstijd (totaal)12.38sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Time-out: 1Verkeerd antwoord: 1Responstijd (gem.)17.50sResponstijd (max)17.50sResponstijd (totaal)17.50sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
17.50sResponstijd (gem.)โฆ
444Totaal aantal invoer-tokensโฆ
35Uitvoer-tokensโฆ
16,680Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2API-fout: 1Responstijd (gem.)22.08sResponstijd (max)43.55sResponstijd (totaal)66.23sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
22.08sResponstijd (gem.)โฆ
665Totaal aantal invoer-tokensโฆ
49Uitvoer-tokensโฆ
26,895Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
2.9Gemiddelde score over alle benchmarktests.โฆ
4.4Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
22.2%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
2Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Time-out: 1Responstijd (gem.)71.07sResponstijd (max)194.23sResponstijd (totaal)213.22sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
1.6Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
1Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Time-out: 1Responstijd (gem.)79.86sResponstijd (max)79.86sResponstijd (totaal)79.86sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
79.86sResponstijd (gem.)โฆ
344Totaal aantal invoer-tokensโฆ
73Uitvoer-tokensโฆ
8,675Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)0msResponstijd (max)0msResponstijd (totaal)0msEen test is alleen volledig geslaagd als alle runs slagen.โฆ
0msResponstijd (gem.)โฆ
0Totaal aantal invoer-tokensโฆ
0Uitvoer-tokensโฆ
0Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
6.1Gemiddelde score over alle benchmarktests.โฆ
3.1Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
1Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)10.05sResponstijd (max)10.05sResponstijd (totaal)10.05sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)31.93sResponstijd (max)31.93sResponstijd (totaal)31.93sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
31.93sResponstijd (gem.)โฆ
699Totaal aantal invoer-tokensโฆ
101Uitvoer-tokensโฆ
7,704Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
6.5Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
50.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)3.40sResponstijd (max)3.40sResponstijd (totaal)3.40sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
3.40sResponstijd (gem.)โฆ
381Totaal aantal invoer-tokensโฆ
27Uitvoer-tokensโฆ
1,383Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)5.38sResponstijd (max)5.70sResponstijd (totaal)10.77sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)32.50sResponstijd (max)49.12sResponstijd (totaal)65.01sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
32.50sResponstijd (gem.)โฆ
696Totaal aantal invoer-tokensโฆ
301Uitvoer-tokensโฆ
13,853Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
5.3Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 2Responstijd (gem.)7.52sResponstijd (max)7.52sResponstijd (totaal)7.52sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
7.52sResponstijd (gem.)โฆ
183Totaal aantal invoer-tokensโฆ
27Uitvoer-tokensโฆ
2,998Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
8.7Gemiddelde score over alle benchmarktests.โฆ
7.9Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
77.8%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
1Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Responstijd (gem.)5.23sResponstijd (max)7.26sResponstijd (totaal)15.69sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)7.54sResponstijd (max)7.54sResponstijd (totaal)7.54sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
7.54sResponstijd (gem.)โฆ
8,193Totaal aantal invoer-tokensโฆ
309Uitvoer-tokensโฆ
909Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)5.87sResponstijd (max)5.87sResponstijd (totaal)5.87sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
5.87sResponstijd (gem.)โฆ
8,193Totaal aantal invoer-tokensโฆ
267Uitvoer-tokensโฆ
1,330Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)9.84sResponstijd (max)9.84sResponstijd (totaal)9.84sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)103.81sResponstijd (max)103.81sResponstijd (totaal)103.81sEen test is alleen volledig geslaagd als alle runs slagen.โฆ
103.81sResponstijd (gem.)โฆ
204Totaal aantal invoer-tokensโฆ
24Uitvoer-tokensโฆ
17,130Redeneer-tokensโฆ
Qwen3.6 Plus PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)0msResponstijd (max)0msResponstijd (totaal)0msEen test is alleen volledig geslaagd als alle runs slagen.โฆ
0msResponstijd (gem.)โฆ
0Totaal aantal invoer-tokensโฆ
0Uitvoer-tokensโฆ
0Redeneer-tokensโฆ
GLM 5 TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.โฆ
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).โฆ
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.โฆ
0Instabiele tests hadden gemengde uitkomsten over runs (minstens รฉรฉn geslaagd en รฉรฉn gefaald).โฆ
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)40.17sResponstijd (max)40.17sResponstijd (totaal)40.17sEen test is alleen volledig geslaagd als alle runs slagen.โฆ