- Rang
- #288
- Gesamte Ausgabe-Token
- 114,654
- Antwortzeit (Durchschnitt)
- 15.23s
- Gesamtkosten
- $0.077
KAT Coder AIR V2.5 (high) vs Laguna XS 2.1
Laguna XS 2.1 führt beim Durchschnittsscore mit 5.3 vs 5.2. Laguna XS 2.1 hat die niedrigeren Benchmark-Kosten mit $0.019 vs $0.077. Laguna XS 2.1 ist schneller mit 4.56s vs 15.23s, mit Erfolgsraten von 40.6% vs 29.0%.
Verglichene Modelle
- Rang
- #283
- Gesamte Ausgabe-Token
- 23,173
- Antwortzeit (Durchschnitt)
- 4.56s
- Gesamtkosten
- $0.019
Empfohlenes Modell
Laguna XS 2.1
Es hat hier die beste Punktzahl (5.3) und kostet etwa 4.0x weniger als KAT Coder AIR V2.5 (high).
Detaillierter Vergleich
| Metrik | KAT Coder AIR V2.5 KAT Coder AIR V2.5 high | Laguna XS 2.1 Laguna XS 2.1 none Kostenlos verfügbar |
|---|---|---|
| Punktzahl | 5.2 | 5.3 |
| Rang | #288 | #283 |
| Zuverlässigkeit | 9.8 | 10.0 |
| Konsistenz | 8.2 | 9.1 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 40.6% | 29.0% |
| Instabile Tests | 5 | 3 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 1.091 | 0.380 |
| Gesamtkosten | $0.077 | $0.019 |
| Eingabepreis | $0.000 / 1M | $0.060 / 1M |
| Ausgabepreis | $0.000 / 1M | $0.120 / 1M |
| Gesamte Eingabe-Token | 50,423 | 270,072 |
| Ausgabe-Token | 4,144 | 23,173 |
| Denk-Token | 110,510 | 0 |
| Antwortzeit (Durchschnitt) | 15.23s | 4.56s |
| Antwortzeit (Maximum) | 118.35s | 70.79s |
| Antwortzeit (Gesamt) | 350.26s | 104.80s |
| Parameter | ~35B insgesamt (~3B aktiv) | 33B insgesamt (3B aktiv) |
| Verfügbarkeit | Geschlossen | Gewichte verfügbar |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#288 KAT Coder AIR V2.5
high
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Kosten
- $0.000
- Zeit
- 300.0s
- Token
- 0 tok
#283 Laguna XS 2.1
none- Kosten
- $0.001
- Zeit
- 27.6s
- Token
- 4,344 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.10s | 0 | 0 | 0 | |
| Laguna XS 2.1 | 5.0 | 10.0 | 0.0% | 0 | 70.79s | 178,465 | 9,796 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.9 | 5.8 | 75.0% | 2 | 2.49s | 615 | 204 | 1,290 | |
| Laguna XS 2.1 | 5.3 | 8.3 | 33.3% | 1 | 755ms | 774 | 1,015 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 4.3 | 7.3 | 11.1% | 1 | 39.07s | 6,948 | 1,166 | 55,883 | |
| Laguna XS 2.1 | 4.3 | 7.8 | 22.2% | 1 | 623ms | 7,995 | 562 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 74.48s | 23,854 | 485 | 28,559 | |
| Laguna XS 2.1 | 3.0 | 10.0 | 0.0% | 0 | 10.39s | 64,647 | 10,328 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 3.59s | 7,776 | 284 | 2,140 | |
| Laguna XS 2.1 | 10.0 | 10.0 | 100.0% | 0 | 768ms | 7,734 | 240 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 7.28s | 724 | 1,101 | 7,738 | |
| Laguna XS 2.1 | 5.3 | 10.0 | 33.3% | 0 | 303ms | 843 | 14 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 5.1 | 10.0 | 0.0% | 0 | 7.10s | 516 | 179 | 539 | |
| Laguna XS 2.1 | 5.0 | 10.0 | 0.0% | 0 | 529ms | 537 | 128 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 9.8 | 10.0 | 100.0% | 0 | 1.51s | 699 | 90 | 675 | |
| Laguna XS 2.1 | 3.8 | 5.8 | 33.3% | 1 | 364ms | 638 | 50 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.5 | 4.4 | 33.3% | 2 | 2.47s | 696 | 285 | 1,576 | |
| Laguna XS 2.1 | 3.0 | 10.0 | 0.0% | 0 | 1.01s | 771 | 730 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 4.77s | 8,391 | 330 | 1,082 | |
| Laguna XS 2.1 | 10.0 | 10.0 | 100.0% | 0 | 1.36s | 7,413 | 300 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 21.72s | 204 | 20 | 11,028 | |
| Laguna XS 2.1 | 3.0 | 10.0 | 0.0% | 0 | 254ms | 255 | 10 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Ling 3.0 FlashnonevsKAT Coder AIR V2.5highKAT Coder AIR V2.5highvsInkling SmalllowKostenlos verfügbarKAT Coder AIR V2.5highvsMistral Small 4mediumKAT Coder AIR V2.5highvsMistral Small 4noneGranite 4.2 8BlowvsLaguna XS 2.1noneKostenlos verfügbarLaguna XS 2.1noneKostenlos verfügbarvsInkling SmalllowKostenlos verfügbarMercury 2.5lowvsKAT Coder AIR V2.5highKAT Coder AIR V2.5highvsMiMo-V2.5-PrononeNemotron 3.5 LightninghighKostenlos verfügbarvsLaguna XS 2.1noneKostenlos verfügbarKAT Coder AIR V2.5highvsQwen3.6 35B A3BnoneLaguna XS 2.1noneKostenlos verfügbarvsStep 3.5 FlashmediumLaguna XS 2.1noneKostenlos verfügbarvsHy4 previewlow