- Rang
- #274
- Gesamte Ausgabe-Token
- 84,218
- Antwortzeit (Durchschnitt)
- 28.46s
- Gesamtkosten
- $0.353
Mistral Large 4 vs Space Bunny Alpha (low)
Space Bunny Alpha (low) führt beim Durchschnittsscore mit 5.7 vs 5.5. Space Bunny Alpha (low) hat die niedrigeren Benchmark-Kosten mit $0.000 vs $0.353. Mistral Large 4 ist schneller mit 28.46s vs 30.63s, mit Erfolgsraten von 30.4% vs 53.6%.
Verglichene Modelle
- Rang
- #269
- Gesamte Ausgabe-Token
- 194,450
- Antwortzeit (Durchschnitt)
- 30.63s
- Gesamtkosten
- $0.000
Empfohlenes Modell
Mistral Large 4
Es bietet den besten Gesamtkompromiss: wettbewerbsfähige Punktzahl (5.5), schnellere Antwort als Space Bunny Alpha (low) und ausgewogene Kosten.
Detaillierter Vergleich
| Metrik | Mistral Large 4 Mistral Large 4 none | Space Bunny Alpha Space Bunny Alpha low |
|---|---|---|
| Punktzahl | 5.5 | 5.7 |
| Rang | #274 | #269 |
| Zuverlässigkeit | 9.9 | 10.0 |
| Konsistenz | 8.8 | 6.5 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 30.4% | 53.6% |
| Instabile Tests | 4 | 10 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 7.044 | 0.000 |
| Gesamtkosten | $0.353 | $0.000 |
| Eingabepreis | $0.680 / 1M | $0.000 / 1M |
| Ausgabepreis | $2.090 / 1M | $0.000 / 1M |
| Preis für Cache-Lesen | $0.070 / 1M | k. A. |
| Preis für Cache-Schreiben | k. A. | k. A. |
| Gesamte Eingabe-Token | 259,048 | 289,086 |
| Ausgabe-Token | 84,218 | 194,450 |
| Denk-Token | 0 | 0 |
| Antwortzeit (Durchschnitt) | 28.46s | 30.63s |
| Antwortzeit (Maximum) | 385.10s | 340.88s |
| Antwortzeit (Gesamt) | 654.47s | 704.47s |
| Parameter | 1.05T insgesamt (49B aktiv) | - |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#274 Mistral Large 4
none- Kosten
- $0.004
- Zeit
- 26.7s
- Token
- 1,923 tok
#269 Space Bunny Alpha
low- Kosten
- $0.000
- Zeit
- 20.6s
- Token
- 3,462 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 4.7 | 3.1 | 33.3% | 1 | 95.35s | 136,700 | 9,370 | 0 | |
| Space Bunny Alpha | 4.7 | 3.1 | 33.3% | 1 | 89.00s | 169,129 | 10,896 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.7 | 8.4 | 8.3% | 1 | 1.52s | 705 | 354 | 0 | |
| Space Bunny Alpha | 6.9 | 5.8 | 75.0% | 2 | 2.75s | 2,130 | 2,255 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 5.4 | 7.8 | 22.2% | 1 | 153.02s | 7,431 | 62,517 | 0 | |
| Space Bunny Alpha | 5.6 | 4.7 | 55.6% | 2 | 6.60s | 8,493 | 5,897 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.0 | 10.0 | 0.0% | 0 | 36.48s | 97,682 | 10,963 | 0 | |
| Space Bunny Alpha | 3.8 | 5.8 | 33.3% | 1 | 12.17s | 85,984 | 8,071 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 1.44s | 7,314 | 189 | 0 | |
| Space Bunny Alpha | 10.0 | 10.0 | 100.0% | 0 | 1.35s | 7,890 | 401 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.0 | 10.0 | 0.0% | 0 | 1.04s | 798 | 21 | 0 | |
| Space Bunny Alpha | 5.3 | 7.2 | 44.4% | 1 | 65.69s | 1,869 | 61,188 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 5.1 | 10.0 | 0.0% | 0 | 2.32s | 516 | 182 | 0 | |
| Space Bunny Alpha | 4.4 | 9.9 | 0.0% | 0 | 2.78s | 855 | 427 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 6.5 | 10.0 | 50.0% | 0 | 1.13s | 708 | 60 | 0 | |
| Space Bunny Alpha | 4.4 | 2.7 | 33.3% | 2 | 1.43s | 1,425 | 351 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 6.1 | 7.1 | 55.6% | 1 | 1.85s | 717 | 327 | 0 | |
| Space Bunny Alpha | 7.9 | 9.9 | 66.7% | 0 | 3.51s | 1,782 | 1,939 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 3.60s | 6,267 | 222 | 0 | |
| Space Bunny Alpha | 4.7 | 1.6 | 66.7% | 1 | 3.48s | 8,953 | 370 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.0 | 10.0 | 0.0% | 0 | 1.31s | 210 | 13 | 0 | |
| Space Bunny Alpha | 3.0 | 10.0 | 0.0% | 0 | 340.88s | 576 | 102,655 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Mistral Large 4nonevsNemotron 3 SupermediumKostenlos verfügbarGPT-5.4nonevsSpace Bunny AlphalowGemma 4 31BnoneKostenlos verfügbarvsSpace Bunny AlphalowSpace Bunny AlphalowvsSolar Pro 4noneDots 3 Note PreviewmediumKostenlos verfügbarvsSpace Bunny AlphalowSeed 2.1 TurbononevsSpace Bunny AlphalowGPT-5.4 MininonevsSpace Bunny AlphalowSpace Bunny AlphalowvsGLM 5noneGPT-5 NanomediumvsSpace Bunny AlphalowTrinity Large ThinkinghighvsSpace Bunny AlphalowRing 2.6 1tmediumvsSpace Bunny AlphalowQwen3.5-35B-A3BnonevsSpace Bunny Alphalow