- Rang
- #297
- Gesamte Ausgabe-Token
- 36,870
- Antwortzeit (Durchschnitt)
- 4.92s
- Gesamtkosten
- $0.015
Mercury 2.5 Preview (low) vs KAT Coder AIR V2.5 (medium)
KAT Coder AIR V2.5 (medium) führt beim Durchschnittsscore mit 5.1 vs 5.0. Mercury 2.5 Preview (low) hat die niedrigeren Benchmark-Kosten mit $0.015 vs $0.048. Mercury 2.5 Preview (low) ist schneller mit 4.92s vs 8.32s, mit Erfolgsraten von 44.9% vs 43.5%.
Verglichene Modelle
- Rang
- #294
- Gesamte Ausgabe-Token
- 66,576
- Antwortzeit (Durchschnitt)
- 8.32s
- Gesamtkosten
- $0.048
Empfohlenes Modell
Mercury 2.5 Preview (low)
Die Punktzahl bleibt nah an der besten hier (5.0 vs 5.1) und es kostet etwa 3.3x weniger als KAT Coder AIR V2.5 (medium).
Detaillierter Vergleich
| Metrik | Mercury 2.5 Preview Mercury 2.5 Preview low | KAT Coder AIR V2.5 KAT Coder AIR V2.5 medium |
|---|---|---|
| Punktzahl | 5.0 | 5.1 |
| Rang | #297 | #294 |
| Zuverlässigkeit | 9.9 | 9.6 |
| Konsistenz | 7.1 | 8.9 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 44.9% | 43.5% |
| Instabile Tests | 8 | 3 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 0.244 | 0.596 |
| Gesamtkosten | $0.015 | $0.048 |
| Eingabepreis | $0.000 / 1M | $0.000 / 1M |
| Ausgabepreis | $0.000 / 1M | $0.000 / 1M |
| Gesamte Eingabe-Token | 235,438 | 51,369 |
| Ausgabe-Token | 8,136 | 8,008 |
| Denk-Token | 28,734 | 58,568 |
| Antwortzeit (Durchschnitt) | 4.92s | 8.32s |
| Antwortzeit (Maximum) | 84.47s | 48.19s |
| Antwortzeit (Gesamt) | 113.24s | 191.40s |
| Parameter | ~100B | ~35B insgesamt (~3B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#297 Mercury 2.5 Preview
low- Kosten
- $0.001
- Zeit
- 1.5s
- Token
- 1,169 tok
#294 KAT Coder AIR V2.5
medium- Kosten
- $0.003
- Zeit
- 23.7s
- Token
- 4,924 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 5.0 | 10.0 | 0.0% | 0 | 84.47s | 101,913 | 877 | 4,018 | |
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.05s | 0 | 0 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 5.6 | 3.8 | 66.7% | 3 | 759ms | 786 | 290 | 3,019 | |
| KAT Coder AIR V2.5 | 8.7 | 8.0 | 91.7% | 1 | 3.79s | 672 | 549 | 4,194 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 5.5 | 10.0 | 33.3% | 0 | 972ms | 7,794 | 695 | 2,263 | |
| KAT Coder AIR V2.5 | 3.6 | 7.0 | 22.2% | 1 | 23.37s | 7,893 | 5,199 | 29,973 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 3.0 | 10.0 | 0.0% | 0 | 4.77s | 110,517 | 5,013 | 9,661 | |
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 19.56s | 23,854 | 435 | 6,811 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 6.3 | 5.8 | 66.7% | 1 | 1.12s | 8,309 | 611 | 1,521 | |
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 3.65s | 7,776 | 268 | 1,881 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 4.1 | 4.4 | 44.5% | 2 | 836ms | 849 | 45 | 2,247 | |
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 6.58s | 668 | 673 | 4,670 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 5.0 | 10.0 | 0.0% | 0 | 1.05s | 540 | 105 | 749 | |
| KAT Coder AIR V2.5 | 5.0 | 10.0 | 0.0% | 0 | 9.81s | 516 | 189 | 557 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 6.3 | 10.0 | 50.0% | 0 | 1.60s | 745 | 99 | 1,492 | |
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 1.50s | 699 | 93 | 730 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 8.2 | 7.2 | 88.9% | 1 | 710ms | 777 | 312 | 2,271 | |
| KAT Coder AIR V2.5 | 3.6 | 7.2 | 22.2% | 1 | 1.87s | 696 | 265 | 1,184 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 2.8 | 1.6 | 33.3% | 1 | 1.57s | 2,983 | 76 | 739 | |
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 4.77s | 8,391 | 317 | 906 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 Preview | 3.0 | 10.0 | 0.0% | 0 | 591ms | 225 | 13 | 754 | |
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 15.74s | 204 | 20 | 7,662 |
Schnellvergleich
Vergleichspaar wechseln
Mercury 2.5lowvsKAT Coder AIR V2.5mediumKAT Coder AIR V2.5mediumvsMiMo-V2.5-PrononeKAT Coder AIR V2.5mediumvsMistral Small 4noneMercury 2.5 PreviewlowvsLaguna S 2.1mediumKostenlos verfügbarMercury 2.5 PreviewlowvsMiniMax M2.7mediumDots 3 Note PreviewnoneKostenlos verfügbarvsMercury 2.5 PreviewlowMercury 2.5 PreviewlowvsGPT-4o-mininoneMercury 2.5 PreviewlowvsMiMo-V2.5-PrononeKAT Coder AIR V2.5mediumvsNemotron 3.5 LightninghighKostenlos verfügbarLing 3.0 FlashnonevsKAT Coder AIR V2.5mediumMercury 2.5 PreviewlowvsMistral Small 4noneMercury 2.5 PreviewlowvsMistral Small 4medium