Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Google: Gemini 3.1 Flash Lite

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-08

Metriek Claude Sonnet 4.6 Claude Sonnet 4.6 medium Releasedatum: 2026-02-17 Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Releasedatum: 2026-05-08
Score 7.8 7.6
Rang #35 #44
Betrouwbaarheid 10.0 10.0
Consistentie 9.6 9.2
Correcte tests
Slaagpercentage per poging 70.2% 68.4%
Instabiele tests 1 2
Totaal runs 57 57
Kosten per resultaat 9.515 0.203
Totale kosten $1.237 $0.025
Invoerprijs $3.000 / 1M $0.250 / 1M
Uitvoerprijs $15.000 / 1M $1.500 / 1M
Uitvoer-tokens 45,505 2,702
Redeneer-tokens 28,370 8,596
Responstijd (gem.) 14.25s 1.92s
Responstijd (max) 46.35s 5.66s
Responstijd (totaal) 156.71s 36.49s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
Gemini 3.1 Flash Lite 7.3 6.2 75.0% 2 1.84s 1,013 1,548
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 35.76s 6,894 2,097
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.46s 441 408
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 4.48s 348 975
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.44s 291 697
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
Gemini 3.1 Flash Lite 5.3 10.0 33.3% 0 1.52s 15 1,214
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 1.37s 69 438
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.52s 72 760
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.40s 210 1,191
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 5.66s 234 945
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 3.0 10.0 0.0% 0 30.09s 3,437 1,586
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 1.46s 9 420

Snelle vergelijking

Vergelijkingspaar wisselen