Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Google: Gemma 4 31B

Samenvatting

Benchmarkvergelijking Claude Opus 4.7 vs Gemma 4 31B: Claude Opus 4.7 leidt in gemiddelde score met 7.4 vs 6.3. Gemma 4 31B heeft lagere benchmarkkosten met $0.033 vs $0.505. Claude Opus 4.7 is sneller met 3.02s vs 56.55s, met slagingspercentages van 76.2% vs 69.8%.

Aanbevolen model: Claude Opus 4.7 - Het heeft hier de beste score (7.4) en reageert ongeveer 18.7x sneller dan Gemma 4 31B.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-18

Metriek Claude Opus 4.7 Claude Opus 4.7 none Releasedatum: 2026-04-16 Gemma 4 31B Gemma 4 31B medium Releasedatum: 2026-04-02 Gratis beschikbaar
Score 7.4 6.3
Rang #49 #88
Betrouwbaarheid 10.0 10.0
Consistentie 9.0 9.4
Correcte tests
Slaagpercentage per poging 76.2% 69.8%
Instabiele tests 0 1
Totaal runs 57 63
Kosten per resultaat 3.154 0.257
Totale kosten $0.505 $0.033
Invoerprijs $5.000 / 1M $0.120 / 1M
Uitvoerprijs $25.000 / 1M $0.350 / 1M
Totaal aantal invoer-tokens 69,576 17,957
Uitvoer-tokens 6,265 22,356
Redeneer-tokens 0 65,726
Responstijd (gem.) 3.02s 56.55s
Responstijd (max) 18.27s 437.40s
Responstijd (totaal) 57.44s 1074.41s

Generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 Claude Opus 4.7

none
Kosten
$0.051
Tijd
24.2s
Tokens
2,181 tok

#88 Gemma 4 31B

medium
Kosten
$0.002
Tijd
45.7s
Tokens
2,696 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 894 522 0
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 816 962 2,046
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 3.3 3.3 33.3% 0 2.84s 1,176 494 0
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 37,740 3,504 0
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 10,533 324 0
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 8,334 1,822 2,951
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 1,020 78 0
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 876 4,349 8,985
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 723 257 0
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 567 105 888
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 939 114 0
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 777 533 2,035
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.46s 939 597 0
Gemma 4 31B 9.9 10.0 100.0% 0 26.91s 801 1,795 5,595
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 15,339 372 0
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 3.0 10.0 0.0% 0 1.46s 273 3 0
Gemma 4 31B 3.0 10.0 0.0% 0 90.14s 218 1,692 10,014

Snelle vergelijking

Vergelijkingspaar wisselen