AI BENCHY
Advertise here
#30

Kimi K3

Moonshot AI Veröffentlichung: 2026-07-16 Getestet am: 2026-07-16 22:18 moonshotai/kimi-k3::max
2.8T insgesamt (104B aktiv)MoEGewichte verfügbar

Zusammenfassung

Kimi K3 erreicht 8.0 bei AI BENCHY und liegt auf #30. Das Modell hat 9.1 Zuverlässigkeit, 75.8% Erfolgsrate, $3.112 Gesamtkosten und 122.48s durchschnittliche Antwortzeit.

Was Kimi K3 besonders macht: Am stärksten ist es in Domänenspezifisch, wo es #4 erreicht; am schwächsten ist Werkzeugaufrufe mit #18.

Modelldaten

Recherchiert am 2026-08-12

Angegeben
Parameter
2.8T insgesamt (104B aktiv)
Architektur
MoE
Verfügbarkeit
Gewichte verfügbar
Lizenz
Kimi K3

Punktzahl

8.0

Konsistenz

9.5

Gesamte Ausgabe-Token

200,439

Gesamte Eingabe-Token

34,916

Eingabepreis

$3.000 / 1M

Ausgabepreis

$15.000 / 1M

Korrekte Tests

Falsche Tests: 6

Erfolgsquote pro Versuch: 75.8%

Instabile Tests

1

Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).

Antwortzeit (Durchschnitt)

122.48s

Antwortzeit (Maximum): 766.58s

Antwortzeit (Gesamt): 2327.06s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 MoonshotAI: Kimi K3

max
Kosten
$0.281
Zeit
506.9s
Token
18,863 tok

Testverlauf

Getestet am Punktzahl Zuverlässigkeit Korrekte Tests Gesamtkosten Vergleichen
2026-08-14 02:35 Erneuter Test 7.9 9.0 $3.467 Vergleichen
2026-07-16 22:18 Neuer Test hinzugefügt 8.0 9.1 $3.112 Aktueller Lauf
2026-07-16 17:10 Erster Lauf 8.5 9.4 $3.112 Vergleichen

Dieser Lauf nutzte eine andere Benchmark-Suite. Berücksichtige Suite-Änderungen bei der historischen Einordnung.

Preisverlauf

Historische Preisdaten für dieses Modell von OpenRouter.

Datum Eingabepreis Ausgabepreis
2026-07-16 17:32 $3.000 / 1M $15.000 / 1M

Diagramme

Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Schnellvergleich

Kategorieaufschlüsselung

Kategorie Punktzahl Konsistenz Korrekte Tests
Anti-KI-Tricks 10.0 10.0
Programmierung 10.0 10.0
Kombiniert 6.5 10.0
Datenanalyse und -extraktion 7.3 5.8
Domänenspezifisch 5.9 9.3
Allgemeine Intelligenz 10.0 10.0
Befolgung von Anweisungen 10.0 10.0
Rätsellösen 10.0 10.0
Werkzeugaufrufe 3.0 10.0
Allgemeinwissen 3.0 10.0

Verglichene Modelle