Navigation
Advertise here

Claude Sonnet 5.5 (low) vs Kimi K2.6 (medium)

Der Durchschnittsscore ist mit 6.9 vs 6.8 praktisch gleichauf. Claude Sonnet 5.5 (low) hat die niedrigeren Benchmark-Kosten mit $0.909 vs $1.323. Claude Sonnet 5.5 (low) ist schneller mit 7.46s vs 121.25s, mit Erfolgsraten von 46.4% vs 60.9%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-01

Verglichene Modelle

Rang
#166
Gesamte Ausgabe-Token
32,443
Antwortzeit (Durchschnitt)
7.46s
Gesamtkosten
$0.909
Rang
#168
Gesamte Ausgabe-Token
396,671
Antwortzeit (Durchschnitt)
121.25s
Gesamtkosten
$1.323
Empfohlenes Modell Claude Sonnet 5.5 (low)

Es hat hier die beste Punktzahl (6.9) und antwortet etwa 16.3x schneller als Kimi K2.6 (medium).

Detaillierter Vergleich

Metrik Claude Sonnet 5.5 Claude Sonnet 5.5 low Veröffentlichung: 2026-09-29 Kimi K2.6 Kimi K2.6 medium Veröffentlichung: 2026-04-20
Punktzahl 6.9 6.8
Rang #166 #168
Zuverlässigkeit 10.0 10.0
Konsistenz 9.4 8.4
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 46.4% 60.9%
Instabile Tests 2 4
Gesamtläufe 69 69
Kosten pro Ergebnis 9.082 12.282
Gesamtkosten $0.909 $1.323
Eingabepreis $2.000 / 1M $0.650 / 1M
Ausgabepreis $10.000 / 1M $3.410 / 1M
Gesamte Eingabe-Token 291,853 226,880
Ausgabe-Token 24,116 65,346
Denk-Token 8,327 331,325
Antwortzeit (Durchschnitt) 7.46s 121.25s
Antwortzeit (Maximum) 46.61s 876.20s
Antwortzeit (Gesamt) 171.47s 2667.55s
Parameter ~1T insgesamt (~100B aktiv) 1T insgesamt (32B aktiv)
Verfügbarkeit Geschlossen Gewichte verfügbar

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Claude Sonnet 5.5

low
Kosten
$0.020
Zeit
15.3s
Token
2,077 tok

#168 MoonshotAI: Kimi K2.6

medium
Kosten
$0.013
Zeit
103.4s
Token
3,620 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Claude Sonnet 5.5 3.2 9.7 0.0% 0 5.81s 10,608 5,903 0
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189

Schnellvergleich

Vergleichspaar wechseln