Navigatie
Advertise here

Granite 4.2 8B vs gpt-oss-120b

Granite 4.2 8B leidt in gemiddelde score met 4.4 vs 4.2. gpt-oss-120b heeft lagere benchmarkkosten met $0.016 vs $0.037. gpt-oss-120b is sneller met 28.63s vs 84.66s, met slagingspercentages van 15.9% vs 34.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#355
Totaal aantal uitvoer-tokens
133,268
Responstijd (gem.)
84.66s
Totale kosten
$0.037
Rang
#361
Totaal aantal uitvoer-tokens
62,213
Responstijd (gem.)
28.63s
Totale kosten
$0.016
Aanbevolen model gpt-oss-120b

De score blijft dicht bij de beste score hier (4.2 vs 4.4) en het kost ongeveer 2.3x minder dan Granite 4.2 8B.

Gedetailleerde vergelijking

Metriek Granite 4.2 8B Granite 4.2 8B none Releasedatum: 2026-09-02 gpt-oss-120b gpt-oss-120b none Releasedatum: 2025-08-05
Score 4.4 4.2
Rang #355 #361
Betrouwbaarheid 9.1 10.0
Consistentie 9.3 7.6
Pogingen 69/69 60/69
Correcte tests
Slaagpercentage per poging 15.9% 34.8%
Instabiele tests 2 3
Totaal runs 69 60
Kosten per resultaat 1.206 0.274
Totale kosten $0.037 $0.016
Invoerprijs $0.060 / 1M $0.037 / 1M
Uitvoerprijs $0.250 / 1M $0.170 / 1M
Prijs voor cachelezen $0.015 / 1M n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 226,872 131,652
Uitvoer-tokens 133,268 16,869
Redeneer-tokens 0 53,081
Responstijd (gem.) 84.66s 28.63s
Responstijd (max) 747.17s 140.90s
Responstijd (totaal) 1947.17s 486.69s
Parameters 8B 117B totaal (5.1B actief)
Beschikbaarheid Open-source Open-source

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#355 IBM: Granite 4.2 8B

none
Provider returned error
Kosten
$0.000
Tijd
0.2s
Tokens
0 tok

#361 gpt-oss-120b

none
Er is nog geen showcase-resultaat gegenereerd voor dit model.
Kosten
n.v.t.
Tijd
-
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Granite 4.2 8B 5.5 10.0 33.3% 0 105.60s 8,358 47,944 0
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028

Vergelijkingspaar wisselen