Navigatie
Advertise here

Kimi K2.5 (medium) vs Qwen3.6 27B

Kimi K2.5 (medium) leidt in gemiddelde score met 6.4 vs 6.3. Qwen3.6 27B heeft lagere benchmarkkosten met $0.147 vs $0.841. Qwen3.6 27B is sneller met 12.71s vs 125.76s, met slagingspercentages van 60.9% vs 47.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-03

Vergeleken modellen

Rang
#208
Totaal aantal uitvoer-tokens
241,096
Responstijd (gem.)
125.76s
Totale kosten
$0.841
Rang
#216
Totaal aantal uitvoer-tokens
20,816
Responstijd (gem.)
12.71s
Totale kosten
$0.147
Aanbevolen model Qwen3.6 27B

De score blijft dicht bij de beste score hier (6.3 vs 6.4) en het kost ongeveer 5.7x minder dan Kimi K2.5 (medium).

Gedetailleerde vergelijking

Metriek Kimi K2.5 Kimi K2.5 medium Releasedatum: 2026-01-27 Qwen3.6 27B Qwen3.6 27B none Releasedatum: 2026-04-20
Score 6.4 6.3
Rang #208 #216
Betrouwbaarheid 9.6 10.0
Consistentie 7.1 7.7
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 60.9% 47.8%
Instabiele tests 8 6
Totaal runs 69 69
Kosten per resultaat 6.085 1.874
Totale kosten $0.841 $0.147
Invoerprijs $0.450 / 1M $0.320 / 1M
Uitvoerprijs $2.250 / 1M $3.200 / 1M
Prijs voor cachelezen $0.070 / 1M n.v.t.
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 292,271 250,919
Uitvoer-tokens 55,025 20,816
Redeneer-tokens 186,071 0
Responstijd (gem.) 125.76s 12.71s
Responstijd (max) 566.79s 156.31s
Responstijd (totaal) 2137.84s 292.29s
Parameters 1T totaal (32B actief) 27B
Beschikbaarheid Gewichten beschikbaar Open-source

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 MoonshotAI: Kimi K2.5

medium
Kosten
$0.030
Tijd
58.6s
Tokens
8,683 tok

#216 Qwen3.6 27B

none
Kosten
$0.009
Tijd
83.0s
Tokens
4,549 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

Snelle vergelijking

Vergelijkingspaar wisselen