Navigatie
Advertise here

Granite 4.2 8B (low) vs Kimi K2.6

Kimi K2.6 leidt in gemiddelde score met 5.5 vs 5.3. Granite 4.2 8B (low) heeft lagere benchmarkkosten met $0.036 vs $0.222. Kimi K2.6 is sneller met 26.34s vs 58.20s, met slagingspercentages van 33.3% vs 30.4%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-02

Vergeleken modellen

Rang
#283
Totaal aantal uitvoer-tokens
61,351
Responstijd (gem.)
58.20s
Totale kosten
$0.036
Rang
#268
Totaal aantal uitvoer-tokens
64,022
Responstijd (gem.)
26.34s
Totale kosten
$0.222
Aanbevolen model Granite 4.2 8B (low)

De score blijft dicht bij de beste score hier (5.3 vs 5.5) en het kost ongeveer 6.2x minder dan Kimi K2.6.

Gedetailleerde vergelijking

Metriek Granite 4.2 8B Granite 4.2 8B low Releasedatum: 2026-09-02 Kimi K2.6 Kimi K2.6 none Releasedatum: 2026-04-20
Score 5.3 5.5
Rang #283 #268
Betrouwbaarheid 9.2 10.0
Consistentie 9.7 9.0
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 33.3% 30.4%
Instabiele tests 1 3
Totaal runs 69 69
Kosten per resultaat 0.508 6.999
Totale kosten $0.036 $0.222
Invoerprijs $0.060 / 1M $0.435 / 1M
Uitvoerprijs $0.250 / 1M $1.828 / 1M
Prijs voor cachelezen $0.015 / 1M $0.074 / 1M
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 332,917 241,357
Uitvoer-tokens 18,989 64,022
Redeneer-tokens 42,362 0
Responstijd (gem.) 58.20s 26.34s
Responstijd (max) 566.80s 238.89s
Responstijd (totaal) 1338.65s 605.78s
Parameters 8B 1T totaal (32B actief)
Beschikbaarheid Open-source Gewichten beschikbaar

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#283 IBM: Granite 4.2 8B

low
Provider returned error
Kosten
$0.000
Tijd
0.2s
Tokens
0 tok

#268 MoonshotAI: Kimi K2.6

none
Kosten
$0.020
Tijd
127.4s
Tokens
4,429 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Granite 4.2 8B 5.5 10.0 33.3% 0 13.01s 8,439 2,469 2,984
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0

Snelle vergelijking

Vergelijkingspaar wisselen