Benchmarkvergelijking Qwen3.7 Plus vs GLM 5V Turbo: Qwen3.7 Plus leidt in gemiddelde score met 7.2 vs 5.9. Qwen3.7 Plus heeft lagere benchmarkkosten met $0.023 vs $0.052. Qwen3.7 Plus is sneller met 2.85s vs 2.99s, met slagingspercentages van 47.6% vs 38.1%.
Aanbevolen model: Qwen3.7 Plus - Het heeft hier de beste score (7.2) en kost ongeveer 2.3x minder dan GLM 5V Turbo.
Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-18
GLM 5V TurboGLM 5V TurbononeGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-04-01
Score
7.2Gemiddelde score over alle benchmarktests.…
5.9Gemiddelde score over alle benchmarktests.…
Rang
#60
#105
Betrouwbaarheid
10.0Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
10.0Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
Consistentie
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
Correcte tests
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 10Instructies niet gevolgd: 1Responstijd (gem.)2.85sResponstijd (max)29.38sResponstijd (totaal)59.86sEen test is alleen volledig geslaagd als alle runs slagen.…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 11Instructies niet gevolgd: 2Responstijd (gem.)2.99sResponstijd (max)6.51sResponstijd (totaal)62.74sEen test is alleen volledig geslaagd als alle runs slagen.…
Slaagpercentage per poging
47.6%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
38.1%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
Instabiele tests
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Totaal runs
63Totaal runs…
63Totaal runs…
Kosten per resultaat
0.276Toont de gemiddelde kosten per correct benchmark-antwoord in centen (lager is beter).…
0.645Toont de gemiddelde kosten per correct benchmark-antwoord in centen (lager is beter).…
Totale kosten
$0.023Totale kosten (huidige prijs)…
$0.052Totale kosten (huidige prijs)…
Invoerprijs
$0.320 / 1MInvoerprijs…
$1.200 / 1MInvoerprijs…
Uitvoerprijs
$1.280 / 1MUitvoerprijs…
$4.000 / 1MUitvoerprijs…
Totaal aantal invoer-tokens
42,510Totaal aantal invoer-tokens…
37,100Totaal aantal invoer-tokens…
Uitvoer-tokens
6,578Uitvoer-tokens…
1,766Uitvoer-tokens…
Redeneer-tokens
0Redeneer-tokens…
0Redeneer-tokens…
Responstijd (gem.)
2.85sResponstijd (gem.)…
2.99sResponstijd (gem.)…
Responstijd (max)
29.38sResponstijd (max)…
6.51sResponstijd (max)…
Responstijd (totaal)
59.86sResponstijd (totaal)…
62.74sResponstijd (totaal)…
Generatie-showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
50.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)1.38sResponstijd (max)2.69sResponstijd (totaal)5.51sEen test is alleen volledig geslaagd als alle runs slagen.…
1.38sResponstijd (gem.)…
696Totaal aantal invoer-tokens…
349Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
4.8Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
25.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 3Responstijd (gem.)3.13sResponstijd (max)5.90sResponstijd (totaal)12.50sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)2.15sResponstijd (max)4.39sResponstijd (totaal)6.44sEen test is alleen volledig geslaagd als alle runs slagen.…
2.15sResponstijd (gem.)…
7,911Totaal aantal invoer-tokens…
639Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
5.5Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)3.13sResponstijd (max)5.30sResponstijd (totaal)9.40sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)29.38sResponstijd (max)29.38sResponstijd (totaal)29.38sEen test is alleen volledig geslaagd als alle runs slagen.…
29.38sResponstijd (gem.)…
14,952Totaal aantal invoer-tokens…
4,505Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)6.51sResponstijd (max)6.51sResponstijd (totaal)6.51sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)1.43sResponstijd (max)1.57sResponstijd (totaal)2.86sEen test is alleen volledig geslaagd als alle runs slagen.…
1.43sResponstijd (gem.)…
7,794Totaal aantal invoer-tokens…
243Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)3.81sResponstijd (max)5.69sResponstijd (totaal)7.62sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 3Responstijd (gem.)868msResponstijd (max)1.02sResponstijd (totaal)2.60sEen test is alleen volledig geslaagd als alle runs slagen.…
868msResponstijd (gem.)…
789Totaal aantal invoer-tokens…
18Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
5.3Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)2.09sResponstijd (max)2.39sResponstijd (totaal)6.26sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Responstijd (gem.)1.33sResponstijd (max)1.33sResponstijd (totaal)1.33sEen test is alleen volledig geslaagd als alle runs slagen.…
1.33sResponstijd (gem.)…
522Totaal aantal invoer-tokens…
78Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
4.6Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Responstijd (gem.)2.22sResponstijd (max)2.22sResponstijd (totaal)2.22sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
50.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)929msResponstijd (max)1.05sResponstijd (totaal)1.86sEen test is alleen volledig geslaagd als alle runs slagen.…
929msResponstijd (gem.)…
711Totaal aantal invoer-tokens…
72Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
6.5Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
50.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)1.97sResponstijd (max)2.43sResponstijd (totaal)3.93sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)1.71sResponstijd (max)2.65sResponstijd (totaal)5.13sEen test is alleen volledig geslaagd als alle runs slagen.…
1.71sResponstijd (gem.)…
714Totaal aantal invoer-tokens…
443Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
5.3Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Verkeerd antwoord: 1Responstijd (gem.)2.40sResponstijd (max)3.81sResponstijd (totaal)7.21sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)3.54sResponstijd (max)3.54sResponstijd (totaal)3.54sEen test is alleen volledig geslaagd als alle runs slagen.…
3.54sResponstijd (gem.)…
8,211Totaal aantal invoer-tokens…
222Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)4.86sResponstijd (max)4.86sResponstijd (totaal)4.86sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)1.21sResponstijd (max)1.21sResponstijd (totaal)1.21sEen test is alleen volledig geslaagd als alle runs slagen.…
1.21sResponstijd (gem.)…
210Totaal aantal invoer-tokens…
9Uitvoer-tokens…
0Redeneer-tokens…
GLM 5V TurboGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)2.23sResponstijd (max)2.23sResponstijd (totaal)2.23sEen test is alleen volledig geslaagd als alle runs slagen.…