Navigatie
Advertise here

Gemma 4 31B (medium) vs GPT-5.6 Luna (low)

De gemiddelde score is vrijwel gelijk met 6.9 vs 6.9. GPT-5.6 Luna (low) heeft lagere benchmarkkosten met $0.049 vs $0.144. GPT-5.6 Luna (low) is sneller met 6.96s vs 78.76s, met slagingspercentages van 66.7% vs 56.5%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-09

Vergeleken modellen

Rang
#176
Totaal aantal uitvoer-tokens
277,315
Responstijd (gem.)
78.76s
Totale kosten
$0.144
Rang
#177
Totaal aantal uitvoer-tokens
28,001
Responstijd (gem.)
6.96s
Totale kosten
$0.049
Aanbevolen model GPT-5.6 Luna (low)

Het heeft hier de beste score (6.9) en kost ongeveer 2.9x minder dan Gemma 4 31B (medium).

Gedetailleerde vergelijking

Metriek Gemma 4 31B Gemma 4 31B medium Releasedatum: 2026-04-02 Gratis beschikbaar GPT-5.6 Luna GPT-5.6 Luna low Releasedatum: 2026-07-09
Score 6.9 6.9
Rang #176 #177
Betrouwbaarheid 10.0 10.0
Consistentie 8.7 8.3
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 66.7% 56.5%
Instabiele tests 3 5
Totaal runs 69 69
Kosten per resultaat 1.195 2.428
Totale kosten $0.144 $0.049
Invoerprijs $0.090 / 1M $0.200 / 1M
Uitvoerprijs $0.340 / 1M $1.200 / 1M
Prijs voor cachelezen $0.050 / 1M $0.020 / 1M
Prijs voor cacheschrijven n.v.t. $0.250 / 1M
Totaal aantal invoer-tokens 251,164 202,680
Uitvoer-tokens 36,112 9,230
Redeneer-tokens 241,203 18,771
Responstijd (gem.) 78.76s 6.96s
Responstijd (max) 437.40s 45.74s
Responstijd (totaal) 1653.96s 160.19s
Parameters 30.7B ~400B totaal (~17B actief)
Beschikbaarheid Open-source Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#176 Gemma 4 31B

medium
Kosten
$0.002
Tijd
45.7s
Tokens
2,696 tok

#177 GPT-5.6 Luna

low
Kosten
$0.011
Tijd
10.2s
Tokens
1,897 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

Vergelijkingspaar wisselen