Navigatie
Advertise here

Granite 4.1 8b (default) vs gpt-oss-120b

gpt-oss-120b leidt in gemiddelde score met 4.2 vs 3.8. Granite 4.1 8b (default) heeft lagere benchmarkkosten met $0.007 vs $0.016. Granite 4.1 8b (default) is sneller met 1.38s vs 28.63s, met slagingspercentages van 8.7% vs 34.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#366
Totaal aantal uitvoer-tokens
5,996
Responstijd (gem.)
1.38s
Totale kosten
$0.007
Rang
#356
Totaal aantal uitvoer-tokens
62,213
Responstijd (gem.)
28.63s
Totale kosten
$0.016
Aanbevolen model Granite 4.1 8b (default)

De score blijft dicht bij de beste score hier (3.8 vs 4.2) en het kost ongeveer 2.5x minder dan gpt-oss-120b.

Gedetailleerde vergelijking

Metriek Granite 4.1 8b Granite 4.1 8b default Releasedatum: 2026-05-01 gpt-oss-120b gpt-oss-120b none Releasedatum: 2025-08-05
Score 3.8 4.2
Rang #366 #356
Betrouwbaarheid 10.0 10.0
Consistentie 10.0 7.6
Pogingen 69/69 60/69
Correcte tests
Slaagpercentage per poging 8.7% 34.8%
Instabiele tests 0 3
Totaal runs 69 60
Kosten per resultaat 0.315 0.274
Totale kosten $0.007 $0.016
Invoerprijs $0.050 / 1M $0.037 / 1M
Uitvoerprijs $0.100 / 1M $0.170 / 1M
Prijs voor cachelezen n.v.t. n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 113,836 131,652
Uitvoer-tokens 5,996 16,869
Redeneer-tokens 0 53,081
Responstijd (gem.) 1.38s 28.63s
Responstijd (max) 16.67s 140.90s
Responstijd (totaal) 31.81s 486.69s
Parameters 8B 117B totaal (5.1B actief)
Beschikbaarheid Open-source Open-source

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#366 Granite 4.1 8b

default
Kosten
$0.001
Tijd
3.2s
Tokens
491 tok

#356 gpt-oss-120b

none
Er is nog geen showcase-resultaat gegenereerd voor dit model.
Kosten
n.v.t.
Tijd
-
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Granite 4.1 8b 4.5 10.0 0.0% 0 775ms 8,344 525 0
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028

Snelle vergelijking

Vergelijkingspaar wisselen