- Rang
- #288
- Gesamte Ausgabe-Token
- 114,654
- Antwortzeit (Durchschnitt)
- 15.23s
- Gesamtkosten
- $0.077
KAT Coder AIR V2.5 (high) vs Mistral Small 4
Der Durchschnittsscore ist mit 5.2 vs 5.1 praktisch gleichauf. Mistral Small 4 hat die niedrigeren Benchmark-Kosten mit $0.047 vs $0.077. Mistral Small 4 ist schneller mit 3.12s vs 15.23s, mit Erfolgsraten von 40.6% vs 24.6%.
Verglichene Modelle
- Rang
- #292
- Gesamte Ausgabe-Token
- 10,913
- Antwortzeit (Durchschnitt)
- 3.12s
- Gesamtkosten
- $0.047
Empfohlenes Modell
Mistral Small 4
Es hat hier die beste Punktzahl (5.1) und kostet etwa 1.6x weniger als KAT Coder AIR V2.5 (high).
Detaillierter Vergleich
| Metrik | KAT Coder AIR V2.5 KAT Coder AIR V2.5 high | Mistral Small 4 Mistral Small 4 none |
|---|---|---|
| Punktzahl | 5.2 | 5.1 |
| Rang | #288 | #292 |
| Zuverlässigkeit | 9.8 | 10.0 |
| Konsistenz | 8.2 | 9.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 40.6% | 24.6% |
| Instabile Tests | 5 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 1.091 | 0.928 |
| Gesamtkosten | $0.077 | $0.047 |
| Eingabepreis | $0.000 / 1M | $0.150 / 1M |
| Ausgabepreis | $0.000 / 1M | $0.600 / 1M |
| Gesamte Eingabe-Token | 50,423 | 265,602 |
| Ausgabe-Token | 4,144 | 10,913 |
| Denk-Token | 110,510 | 0 |
| Antwortzeit (Durchschnitt) | 15.23s | 3.12s |
| Antwortzeit (Maximum) | 118.35s | 45.46s |
| Antwortzeit (Gesamt) | 350.26s | 71.87s |
| Parameter | ~35B insgesamt (~3B aktiv) | 119B insgesamt (6B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#288 KAT Coder AIR V2.5
high
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Kosten
- $0.000
- Zeit
- 300.0s
- Token
- 0 tok
#292 Mistral Small 4
none- Kosten
- $0.002
- Zeit
- 10.4s
- Token
- 2,370 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.10s | 0 | 0 | 0 | |
| Mistral Small 4 | 5.0 | 10.0 | 0.0% | 0 | 45.46s | 160,885 | 1,101 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.9 | 5.8 | 75.0% | 2 | 2.49s | 615 | 204 | 1,290 | |
| Mistral Small 4 | 3.4 | 7.9 | 16.7% | 1 | 395ms | 708 | 182 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 4.3 | 7.3 | 11.1% | 1 | 39.07s | 6,948 | 1,166 | 55,883 | |
| Mistral Small 4 | 3.7 | 9.7 | 0.0% | 0 | 901ms | 7,636 | 619 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 74.48s | 23,854 | 485 | 28,559 | |
| Mistral Small 4 | 3.0 | 10.0 | 0.0% | 0 | 7.44s | 79,039 | 8,107 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 3.59s | 7,776 | 284 | 2,140 | |
| Mistral Small 4 | 10.0 | 10.0 | 100.0% | 0 | 822ms | 7,914 | 261 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 7.28s | 724 | 1,101 | 7,738 | |
| Mistral Small 4 | 5.3 | 10.0 | 33.3% | 0 | 377ms | 807 | 28 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 5.1 | 10.0 | 0.0% | 0 | 7.10s | 516 | 179 | 539 | |
| Mistral Small 4 | 4.0 | 10.0 | 0.0% | 0 | 729ms | 519 | 205 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 9.8 | 10.0 | 100.0% | 0 | 1.51s | 699 | 90 | 675 | |
| Mistral Small 4 | 6.5 | 10.0 | 50.0% | 0 | 380ms | 729 | 69 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.5 | 4.4 | 33.3% | 2 | 2.47s | 696 | 285 | 1,576 | |
| Mistral Small 4 | 3.1 | 9.9 | 0.0% | 0 | 399ms | 735 | 111 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 4.77s | 8,391 | 330 | 1,082 | |
| Mistral Small 4 | 10.0 | 10.0 | 100.0% | 0 | 1.40s | 6,420 | 213 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 21.72s | 204 | 20 | 11,028 | |
| Mistral Small 4 | 3.0 | 10.0 | 0.0% | 0 | 397ms | 210 | 17 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Mercury 2.5lowvsMistral Small 4noneKAT Coder AIR V2.5mediumvsMistral Small 4noneLing 3.0 FlashnonevsKAT Coder AIR V2.5highKAT Coder AIR V2.5highvsInkling SmalllowKostenlos verfügbarKAT Coder AIR V2.5highvsMistral Small 4mediumMistral Small 4nonevsNemotron 3.5 LightninghighKostenlos verfügbarMercury 2.5lowvsKAT Coder AIR V2.5highKAT Coder AIR V2.5highvsMiMo-V2.5-PrononeMistral Small 4nonevsLaguna S 2.1mediumKostenlos verfügbarMistral Small 4nonevsInkling SmalllowKostenlos verfügbarKAT Coder AIR V2.5highvsQwen3.6 35B A3BnoneKAT Coder AIR V2.5highvsLaguna XS 2.1noneKostenlos verfügbar