Navigatie
Advertise here

Kimi K2.5 (medium) vs Grok 4.3 (medium)

Grok 4.3 (medium) leidt in gemiddelde score met 6.5 vs 6.4. Kimi K2.5 (medium) heeft lagere benchmarkkosten met $0.841 vs $0.989. Grok 4.3 (medium) is sneller met 44.53s vs 125.76s, met slagingspercentages van 60.9% vs 63.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-03

Vergeleken modellen

Rang
#208
Totaal aantal uitvoer-tokens
241,096
Responstijd (gem.)
125.76s
Totale kosten
$0.841
Rang
#202
Totaal aantal uitvoer-tokens
232,542
Responstijd (gem.)
44.53s
Totale kosten
$0.989
Aanbevolen model Grok 4.3 (medium)

Het heeft hier de beste score (6.5) en reageert ongeveer 2.8x sneller dan Kimi K2.5 (medium).

Gedetailleerde vergelijking

Metriek Kimi K2.5 Kimi K2.5 medium Releasedatum: 2026-01-27 Grok 4.3 Grok 4.3 medium Releasedatum: 2026-05-01
Score 6.4 6.5
Rang #208 #202
Betrouwbaarheid 9.6 10.0
Consistentie 7.1 8.3
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 60.9% 63.8%
Instabiele tests 8 5
Totaal runs 69 69
Kosten per resultaat 6.085 8.235
Totale kosten $0.841 $0.989
Invoerprijs $0.450 / 1M $1.250 / 1M
Uitvoerprijs $2.250 / 1M $2.500 / 1M
Prijs voor cachelezen $0.070 / 1M $0.200 / 1M
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 292,271 325,471
Uitvoer-tokens 55,025 14,867
Redeneer-tokens 186,071 217,675
Responstijd (gem.) 125.76s 44.53s
Responstijd (max) 566.79s 216.69s
Responstijd (totaal) 2137.84s 1024.25s
Parameters 1T totaal (32B actief) ~1.5T totaal (~150B actief)
Beschikbaarheid Gewichten beschikbaar Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 MoonshotAI: Kimi K2.5

medium
Kosten
$0.030
Tijd
58.6s
Tokens
8,683 tok

#202 SpaceXAI: Grok 4.3

medium
Kosten
$0.009
Tijd
19.0s
Tokens
3,661 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

Snelle vergelijking

Vergelijkingspaar wisselen