- Rang
- #294
- Gesamte Ausgabe-Token
- 66,576
- Antwortzeit (Durchschnitt)
- 8.32s
- Gesamtkosten
- $0.048
KAT Coder AIR V2.5 (medium) vs Mistral Small 4
Der Durchschnittsscore ist mit 5.1 vs 5.1 praktisch gleichauf. Mistral Small 4 hat die niedrigeren Benchmark-Kosten mit $0.047 vs $0.048. Mistral Small 4 ist schneller mit 3.12s vs 8.32s, mit Erfolgsraten von 43.5% vs 24.6%.
Verglichene Modelle
- Rang
- #292
- Gesamte Ausgabe-Token
- 10,913
- Antwortzeit (Durchschnitt)
- 3.12s
- Gesamtkosten
- $0.047
Empfohlenes Modell
Mistral Small 4
Es hat hier die beste Punktzahl (5.1) und antwortet etwa 2.7x schneller als KAT Coder AIR V2.5 (medium).
Detaillierter Vergleich
| Metrik | KAT Coder AIR V2.5 KAT Coder AIR V2.5 medium | Mistral Small 4 Mistral Small 4 none |
|---|---|---|
| Punktzahl | 5.1 | 5.1 |
| Rang | #294 | #292 |
| Zuverlässigkeit | 9.6 | 10.0 |
| Konsistenz | 8.9 | 9.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 43.5% | 24.6% |
| Instabile Tests | 3 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 0.596 | 0.928 |
| Gesamtkosten | $0.048 | $0.047 |
| Eingabepreis | $0.000 / 1M | $0.150 / 1M |
| Ausgabepreis | $0.000 / 1M | $0.600 / 1M |
| Gesamte Eingabe-Token | 51,369 | 265,602 |
| Ausgabe-Token | 8,008 | 10,913 |
| Denk-Token | 58,568 | 0 |
| Antwortzeit (Durchschnitt) | 8.32s | 3.12s |
| Antwortzeit (Maximum) | 48.19s | 45.46s |
| Antwortzeit (Gesamt) | 191.40s | 71.87s |
| Parameter | ~35B insgesamt (~3B aktiv) | 119B insgesamt (6B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#294 KAT Coder AIR V2.5
medium- Kosten
- $0.003
- Zeit
- 23.7s
- Token
- 4,924 tok
#292 Mistral Small 4
none- Kosten
- $0.002
- Zeit
- 10.4s
- Token
- 2,370 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.05s | 0 | 0 | 0 | |
| Mistral Small 4 | 5.0 | 10.0 | 0.0% | 0 | 45.46s | 160,885 | 1,101 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 8.7 | 8.0 | 91.7% | 1 | 3.79s | 672 | 549 | 4,194 | |
| Mistral Small 4 | 3.4 | 7.9 | 16.7% | 1 | 395ms | 708 | 182 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.6 | 7.0 | 22.2% | 1 | 23.37s | 7,893 | 5,199 | 29,973 | |
| Mistral Small 4 | 3.7 | 9.7 | 0.0% | 0 | 901ms | 7,636 | 619 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 19.56s | 23,854 | 435 | 6,811 | |
| Mistral Small 4 | 3.0 | 10.0 | 0.0% | 0 | 7.44s | 79,039 | 8,107 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 3.65s | 7,776 | 268 | 1,881 | |
| Mistral Small 4 | 10.0 | 10.0 | 100.0% | 0 | 822ms | 7,914 | 261 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 6.58s | 668 | 673 | 4,670 | |
| Mistral Small 4 | 5.3 | 10.0 | 33.3% | 0 | 377ms | 807 | 28 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 5.0 | 10.0 | 0.0% | 0 | 9.81s | 516 | 189 | 557 | |
| Mistral Small 4 | 4.0 | 10.0 | 0.0% | 0 | 729ms | 519 | 205 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 1.50s | 699 | 93 | 730 | |
| Mistral Small 4 | 6.5 | 10.0 | 50.0% | 0 | 380ms | 729 | 69 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.6 | 7.2 | 22.2% | 1 | 1.87s | 696 | 265 | 1,184 | |
| Mistral Small 4 | 3.1 | 9.9 | 0.0% | 0 | 399ms | 735 | 111 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 4.77s | 8,391 | 317 | 906 | |
| Mistral Small 4 | 10.0 | 10.0 | 100.0% | 0 | 1.40s | 6,420 | 213 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 15.74s | 204 | 20 | 7,662 | |
| Mistral Small 4 | 3.0 | 10.0 | 0.0% | 0 | 397ms | 210 | 17 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Mercury 2.5lowvsKAT Coder AIR V2.5mediumKAT Coder AIR V2.5mediumvsMiMo-V2.5-PrononeMercury 2.5lowvsMistral Small 4noneKAT Coder AIR V2.5highvsMistral Small 4noneMistral Small 4nonevsNemotron 3.5 LightninghighKostenlos verfügbarMistral Small 4nonevsLaguna S 2.1mediumKostenlos verfügbarKAT Coder AIR V2.5mediumvsNemotron 3.5 LightninghighKostenlos verfügbarMercury 2.5 PreviewlowvsKAT Coder AIR V2.5mediumMistral Small 4nonevsInkling SmalllowKostenlos verfügbarLing 3.0 FlashnonevsKAT Coder AIR V2.5mediumMercury 2.5 PreviewlowvsMistral Small 4noneKAT Coder AIR V2.5mediumvsInkling SmalllowKostenlos verfügbar