- Rang
- #39
- Gesamte Ausgabe-Token
- 727,349
- Antwortzeit (Durchschnitt)
- 83.04s
- Gesamtkosten
- $7.545
Claude Sonnet 5.5 (max) vs Muse Spark 1.3 (high)
Claude Sonnet 5.5 (max) führt beim Durchschnittsscore mit 9.0 vs 8.9. Muse Spark 1.3 (high) hat die niedrigeren Benchmark-Kosten mit $1.653 vs $7.545. Muse Spark 1.3 (high) ist schneller mit 52.49s vs 83.04s, mit Erfolgsraten von 81.8% vs 77.3%.
Verglichene Modelle
- Rang
- #44
- Gesamte Ausgabe-Token
- 359,608
- Antwortzeit (Durchschnitt)
- 52.49s
- Gesamtkosten
- $1.653
Empfohlenes Modell
Muse Spark 1.3 (high)
Die Punktzahl bleibt nah an der besten hier (8.9 vs 9.0) und es kostet etwa 4.6x weniger als Claude Sonnet 5.5 (max).
Detaillierter Vergleich
| Metrik | Claude Sonnet 5.5 Claude Sonnet 5.5 max | Muse Spark 1.3 Muse Spark 1.3 high |
|---|---|---|
| Punktzahl | 9.0 | 8.9 |
| Rang | #39 | #44 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.4 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 81.8% | 77.3% |
| Instabile Tests | 2 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 44.380 | 10.327 |
| Gesamtkosten | $7.545 | $1.653 |
| Eingabepreis | $2.000 / 1M | $1.250 / 1M |
| Ausgabepreis | $10.000 / 1M | $4.250 / 1M |
| Gesamte Eingabe-Token | 135,496 | 99,143 |
| Ausgabe-Token | 8,153 | 12,083 |
| Denk-Token | 719,196 | 347,525 |
| Antwortzeit (Durchschnitt) | 83.04s | 52.49s |
| Antwortzeit (Maximum) | 488.39s | 251.53s |
| Antwortzeit (Gesamt) | 1826.84s | 1154.76s |
| Parameter | ~1T insgesamt (~100B aktiv) | ~1T insgesamt (~50B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#39 Claude Sonnet 5.5
max
OpenRouter returned no showcase content (finish_reason: length).
- Kosten
- $0.000
- Zeit
- 571.7s
- Token
- 0 tok
#44 Muse Spark 1.3
high- Kosten
- $0.050
- Zeit
- 203.3s
- Token
- 11,679 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.39s | 858 | 397 | 3,109 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 5.71s | 618 | 487 | 8,829 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.26s | 10,608 | 580 | 70,730 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 51.66s | 7,275 | 1,228 | 64,287 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 113.57s | 97,957 | 5,219 | 95,067 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 55.55s | 68,737 | 5,707 | 46,328 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 16.07s | 10,515 | 312 | 10,487 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 7.01s | 7,155 | 491 | 6,758 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 5.3 | 10.0 | 33.3% | 0 | 401.38s | 990 | 19 | 485,043 | |
| Muse Spark 1.3 | 2.9 | 7.2 | 11.1% | 1 | 174.56s | 690 | 801 | 114,774 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 5.1 | 3.4 | 33.3% | 1 | 56.66s | 714 | 322 | 20,156 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 9.49s | 477 | 228 | 2,634 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 8.5 | 6.8 | 83.3% | 1 | 6.24s | 921 | 98 | 2,263 | |
| Muse Spark 1.3 | 6.5 | 10.0 | 50.0% | 0 | 14.70s | 669 | 353 | 10,553 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.17s | 912 | 578 | 3,186 | |
| Muse Spark 1.3 | 8.7 | 7.7 | 88.9% | 1 | 38.42s | 651 | 1,178 | 37,874 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 10.0 | 10.0 | 100.0% | 0 | 41.40s | 11,757 | 354 | 12,232 | |
| Muse Spark 1.3 | 9.6 | 10.0 | 100.0% | 0 | 33.95s | 12,688 | 1,046 | 14,673 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 5.5 | 3.0 | 10.0 | 0.0% | 0 | 47.01s | 264 | 274 | 16,923 | |
| Muse Spark 1.3 | 3.0 | 10.0 | 0.0% | 0 | 140.05s | 183 | 564 | 40,815 |
Schnellvergleich
Vergleichspaar wechseln
Claude Sonnet 5.5maxvsQwen3.8 MaxmediumClaude Sonnet 5.5maxvsGPT-5.5mediumClaude Sonnet 5.5maxvsGemini 3.5 FlashmediumMuse Spark 1.3highvsGPT-5.3-CodexmediumMuse Spark 1.3highvsParetononeClaude Sonnet 5.5maxvsGrok 4.5highClaude Sonnet 5.5maxvsQwen3.8 Max (0902)highClaude Sonnet 5.5maxvsGPT-5.3-CodexmediumClaude Sonnet 5.5maxvsQwen3.7 MaxmediumMuse Spark 1.3highvsQwen3.8 MaxmediumMuse Spark 1.3highvsGPT-5.5mediumGemini 3.5 FlashmediumvsMuse Spark 1.3high