Benchmarkvergelijking Gemini 3.5 Flash vs Hunter Alpha: Gemini 3.5 Flash leidt in gemiddelde score met 9.4 vs 6.7. Hunter Alpha heeft lagere benchmarkkosten met $0.000 vs $0.349. Gemini 3.5 Flash is sneller met 3.27s vs 10.33s, met slagingspercentages van 90.5% vs 64.8%.
Aanbevolen model: Gemini 3.5 Flash - Het heeft hier de beste score (9.4) en reageert ongeveer 3.2x sneller dan Hunter Alpha.
Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-10
Hunter AlphaHunter AlphamediumGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.Releasedatum: 2026-03-11
Score
9.4Gemiddelde score over alle benchmarktests.…
6.7Gemiddelde score over alle benchmarktests.…
Rang
#3
#80
Betrouwbaarheid
10.0Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
n.v.t.Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
Consistentie
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
7.4Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
Correcte tests
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)3.27sResponstijd (max)9.05sResponstijd (totaal)68.65sEen test is alleen volledig geslaagd als alle runs slagen.…
90.5%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
64.8%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
Instabiele tests
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
6Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Totaal runs
63Totaal runs…
52Totaal runs…
Kosten per resultaat
1.834Toont de gemiddelde kosten per correct benchmark-antwoord in centen (lager is beter).…
0.000Toont de gemiddelde kosten per correct benchmark-antwoord in centen (lager is beter).…
Totale kosten
$0.349Totale kosten (huidige prijs)…
$0.000Totale kosten (huidige prijs)…
Invoerprijs
$1.500 / 1MInvoerprijs…
$0.000 / 1MInvoerprijs…
Uitvoerprijs
$9.000 / 1MUitvoerprijs…
$0.000 / 1MUitvoerprijs…
Totaal aantal invoer-tokens
36,938Totaal aantal invoer-tokens…
28,927Totaal aantal invoer-tokens…
Uitvoer-tokens
2,033Uitvoer-tokens…
4,682Uitvoer-tokens…
Redeneer-tokens
30,519Redeneer-tokens…
17,969Redeneer-tokens…
Responstijd (gem.)
3.27sResponstijd (gem.)…
10.33sResponstijd (gem.)…
Responstijd (max)
9.05sResponstijd (max)…
30.53sResponstijd (max)…
Responstijd (totaal)
68.65sResponstijd (totaal)…
175.58sResponstijd (totaal)…
Generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#3 Gemini 3.5 Flash
low
Cost
$0.068
Time
39.1s
Tokens
7,588 tok
#80 Hunter Alpha
medium
Hunter Alpha was a stealth model revealed on March 18th as an early testing version of MiMo-V2-Pro. Find it here: https://openrouter.ai/xiaomi/mimo-v2-pro
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)2.52sResponstijd (max)5.40sResponstijd (totaal)10.08sEen test is alleen volledig geslaagd als alle runs slagen.…
2.52sResponstijd (gem.)…
494Totaal aantal invoer-tokens…
209Uitvoer-tokens…
2,536Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
7.3Gemiddelde score over alle benchmarktests.…
5.8Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
83.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
2Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)4.75sResponstijd (max)7.62sResponstijd (totaal)19.00sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)6.71sResponstijd (max)9.05sResponstijd (totaal)20.13sEen test is alleen volledig geslaagd als alle runs slagen.…
6.71sResponstijd (gem.)…
8,118Totaal aantal invoer-tokens…
458Uitvoer-tokens…
13,420Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)0msResponstijd (max)0msResponstijd (totaal)0msEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)6.44sResponstijd (max)6.44sResponstijd (totaal)6.44sEen test is alleen volledig geslaagd als alle runs slagen.…
6.44sResponstijd (gem.)…
12,873Totaal aantal invoer-tokens…
351Uitvoer-tokens…
3,050Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
4.7Gemiddelde score over alle benchmarktests.…
1.6Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Time-out: 1Responstijd (gem.)30.53sResponstijd (max)30.53sResponstijd (totaal)30.53sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)1.81sResponstijd (max)2.32sResponstijd (totaal)3.63sEen test is alleen volledig geslaagd als alle runs slagen.…
1.81sResponstijd (gem.)…
7,548Totaal aantal invoer-tokens…
279Uitvoer-tokens…
1,164Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)23.16sResponstijd (max)26.55sResponstijd (totaal)46.33sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)3.39sResponstijd (max)4.44sResponstijd (totaal)10.16sEen test is alleen volledig geslaagd als alle runs slagen.…
3.39sResponstijd (gem.)…
633Totaal aantal invoer-tokens…
12Uitvoer-tokens…
4,538Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Extra opmaak: 1Time-out: 1Verkeerd antwoord: 1Responstijd (gem.)10.52sResponstijd (max)18.68sResponstijd (totaal)31.56sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)2.27sResponstijd (max)2.27sResponstijd (totaal)2.27sEen test is alleen volledig geslaagd als alle runs slagen.…
2.27sResponstijd (gem.)…
486Totaal aantal invoer-tokens…
119Uitvoer-tokens…
916Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
7.0Gemiddelde score over alle benchmarktests.…
3.7Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Responstijd (gem.)6.44sResponstijd (max)6.44sResponstijd (totaal)6.44sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)1.86sResponstijd (max)2.10sResponstijd (totaal)3.73sEen test is alleen volledig geslaagd als alle runs slagen.…
1.86sResponstijd (gem.)…
615Totaal aantal invoer-tokens…
71Uitvoer-tokens…
1,652Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
9.9Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)4.18sResponstijd (max)4.46sResponstijd (totaal)8.36sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)2.35sResponstijd (max)3.25sResponstijd (totaal)7.06sEen test is alleen volledig geslaagd als alle runs slagen.…
2.35sResponstijd (gem.)…
558Totaal aantal invoer-tokens…
288Uitvoer-tokens…
2,150Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
6.1Gemiddelde score over alle benchmarktests.…
4.7Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
2Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Verkeerd antwoord: 1Responstijd (gem.)5.35sResponstijd (max)6.20sResponstijd (totaal)16.06sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)3.27sResponstijd (max)3.27sResponstijd (totaal)3.27sEen test is alleen volledig geslaagd als alle runs slagen.…
3.27sResponstijd (gem.)…
5,457Totaal aantal invoer-tokens…
234Uitvoer-tokens…
403Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)17.33sResponstijd (max)17.33sResponstijd (totaal)17.33sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)1.88sResponstijd (max)1.88sResponstijd (totaal)1.88sEen test is alleen volledig geslaagd als alle runs slagen.…
1.88sResponstijd (gem.)…
156Totaal aantal invoer-tokens…
12Uitvoer-tokens…
690Redeneer-tokens…
Hunter AlphaGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.