DeepSeek: DeepSeek V4 Flash vs Gemini 3 PRO Preview
Samenvatting
Benchmarkvergelijking DeepSeek V4 Flash vs Gemini 3 PRO Preview: DeepSeek V4 Flash leidt in gemiddelde score met 8.3 vs 6.2. DeepSeek V4 Flash heeft lagere benchmarkkosten met $0.027 vs $0.385. Gemini 3 PRO Preview is sneller met 9.05s vs 45.85s, met slagingspercentages van 74.6% vs 66.7%.
Aanbevolen model: DeepSeek V4 Flash - Het heeft hier de beste score (8.3) en kost ongeveer 14.7x minder dan Gemini 3 PRO Preview.
Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-17
10.0Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
n.v.t.Succescore bij de eerste poging: 10.0 betekent geen herhaalbare doel-API- of snelheidslimietfouten vóór succesvolle calls; geregistreerde fouten verlagen de score.…
Consistentie
8.5Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
Correcte tests
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 6Instructies niet gevolgd: 2Responstijd (gem.)45.85sResponstijd (max)218.13sResponstijd (totaal)962.79sEen test is alleen volledig geslaagd als alle runs slagen.…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 4Verkeerd antwoord: 3Responstijd (gem.)9.05sResponstijd (max)26.24sResponstijd (totaal)90.53sEen test is alleen volledig geslaagd als alle runs slagen.…
Slaagpercentage per poging
74.6%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
Instabiele tests
4Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Totaal runs
63Totaal runs…
63Totaal runs…
Kosten per resultaat
0.299Toont de gemiddelde kosten per correct benchmark-antwoord in centen (lager is beter).…
1.406Toont de gemiddelde kosten per correct benchmark-antwoord in centen (lager is beter).…
Totale kosten
$0.027Totale kosten (huidige prijs)…
$0.385Totale kosten (huidige prijs)…
Invoerprijs
$0.090 / 1MInvoerprijs…
$9.506 / 1MInvoerprijs…
Uitvoerprijs
$0.180 / 1MUitvoerprijs…
$9.506 / 1MUitvoerprijs…
Totaal aantal invoer-tokens
39,745Totaal aantal invoer-tokens…
28,848Totaal aantal invoer-tokens…
Uitvoer-tokens
10,310Uitvoer-tokens…
1,490Uitvoer-tokens…
Redeneer-tokens
123,501Redeneer-tokens…
10,102Redeneer-tokens…
Responstijd (gem.)
45.85sResponstijd (gem.)…
9.05sResponstijd (gem.)…
Responstijd (max)
218.13sResponstijd (max)…
26.24sResponstijd (max)…
Responstijd (totaal)
962.79sResponstijd (totaal)…
90.53sResponstijd (totaal)…
Generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#23 DeepSeek V4 Flash
high
Cost
$0.003
Time
93.1s
Tokens
7,926 tok
#91 Gemini 3 PRO Preview
medium
No endpoints found for google/gemini-3-pro-preview.
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
75.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)28.51sResponstijd (max)39.73sResponstijd (totaal)114.05sEen test is alleen volledig geslaagd als alle runs slagen.…
28.51sResponstijd (gem.)…
540Totaal aantal invoer-tokens…
140Uitvoer-tokens…
7,770Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)14.99sResponstijd (max)26.24sResponstijd (totaal)29.99sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)50.60sResponstijd (max)62.48sResponstijd (totaal)151.79sEen test is alleen volledig geslaagd als alle runs slagen.…
50.60sResponstijd (gem.)…
7,279Totaal aantal invoer-tokens…
395Uitvoer-tokens…
34,862Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 3Responstijd (gem.)0msResponstijd (max)0msResponstijd (totaal)0msEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)76.57sResponstijd (max)76.57sResponstijd (totaal)76.57sEen test is alleen volledig geslaagd als alle runs slagen.…
76.57sResponstijd (gem.)…
14,016Totaal aantal invoer-tokens…
465Uitvoer-tokens…
7,347Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)10.37sResponstijd (max)10.37sResponstijd (totaal)10.37sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)28.03sResponstijd (max)30.49sResponstijd (totaal)56.07sEen test is alleen volledig geslaagd als alle runs slagen.…
28.03sResponstijd (gem.)…
7,290Totaal aantal invoer-tokens…
201Uitvoer-tokens…
1,179Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)10.84sResponstijd (max)10.84sResponstijd (totaal)10.84sEen test is alleen volledig geslaagd als alle runs slagen.…
4.4Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
44.5%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
2Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 3Responstijd (gem.)100.31sResponstijd (max)218.13sResponstijd (totaal)300.92sEen test is alleen volledig geslaagd als alle runs slagen.…
100.31sResponstijd (gem.)…
666Totaal aantal invoer-tokens…
27Uitvoer-tokens…
59,249Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
5.3Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
33.3%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 2Responstijd (gem.)7.01sResponstijd (max)7.01sResponstijd (totaal)7.01sEen test is alleen volledig geslaagd als alle runs slagen.…
3.1Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
66.7%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Responstijd (gem.)25.15sResponstijd (max)25.15sResponstijd (totaal)25.15sEen test is alleen volledig geslaagd als alle runs slagen.…
25.15sResponstijd (gem.)…
471Totaal aantal invoer-tokens…
79Uitvoer-tokens…
632Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)9.34sResponstijd (max)9.34sResponstijd (totaal)9.34sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)15.36sResponstijd (max)19.53sResponstijd (totaal)30.73sEen test is alleen volledig geslaagd als alle runs slagen.…
15.36sResponstijd (gem.)…
627Totaal aantal invoer-tokens…
63Uitvoer-tokens…
1,622Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
9.8Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)3.26sResponstijd (max)3.26sResponstijd (totaal)3.26sEen test is alleen volledig geslaagd als alle runs slagen.…
7.2Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
88.9%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
1Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Instructies niet gevolgd: 1Responstijd (gem.)26.11sResponstijd (max)32.37sResponstijd (totaal)78.32sEen test is alleen volledig geslaagd als alle runs slagen.…
26.11sResponstijd (gem.)…
594Totaal aantal invoer-tokens…
196Uitvoer-tokens…
1,767Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)3.88sResponstijd (max)4.23sResponstijd (totaal)7.77sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)74.73sResponstijd (max)74.73sResponstijd (totaal)74.73sEen test is alleen volledig geslaagd als alle runs slagen.…
74.73sResponstijd (gem.)…
8,079Totaal aantal invoer-tokens…
228Uitvoer-tokens…
542Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
10.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
100.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Geen mislukte antwoorden.Responstijd (gem.)11.96sResponstijd (max)11.96sResponstijd (totaal)11.96sEen test is alleen volledig geslaagd als alle runs slagen.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.Verkeerd antwoord: 1Responstijd (gem.)54.46sResponstijd (max)54.46sResponstijd (totaal)54.46sEen test is alleen volledig geslaagd als alle runs slagen.…
54.46sResponstijd (gem.)…
183Totaal aantal invoer-tokens…
8,516Uitvoer-tokens…
8,531Redeneer-tokens…
Gemini 3 PRO PreviewGearchiveerd model: dit model wordt niet langer bijgewerkt of getest op nieuwe tests.
3.0Gemiddelde score over alle benchmarktests.…
10.0Consistentie geeft stabiliteit tussen runs weer (10 = zeer consistent, zelfs als consequent fout).…
0.0%Slaagpercentage per poging = geslaagde pogingen / totale pogingen over alle runs.…
0Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).…
Een test is alleen volledig geslaagd als alle runs slagen.API-fout: 1Responstijd (gem.)0msResponstijd (max)0msResponstijd (totaal)0msEen test is alleen volledig geslaagd als alle runs slagen.…