- Rang
- #37
- Gesamte Ausgabe-Token
- 319,264
- Antwortzeit (Durchschnitt)
- 38.57s
- Gesamtkosten
- $1.469
Muse Spark 1.3 (medium) vs Qwen3.8 Max (0902) (medium)
Der Durchschnittsscore ist mit 8.8 vs 8.8 praktisch gleichauf. Qwen3.8 Max (0902) (medium) hat die niedrigeren Benchmark-Kosten mit $0.677 vs $1.469. Qwen3.8 Max (0902) (medium) ist schneller mit 26.01s vs 38.57s, mit Erfolgsraten von 84.9% vs 83.3%.
- Rang
- #36
- Gesamte Ausgabe-Token
- 80,678
- Antwortzeit (Durchschnitt)
- 26.01s
- Gesamtkosten
- $0.677
Empfohlenes Modell
Qwen3.8 Max (0902) (medium)
Es hat hier die beste Punktzahl (8.8) und kostet etwa 2.2x weniger als Muse Spark 1.3 (medium).
Detaillierter Vergleich
| Metrik | Muse Spark 1.3 Muse Spark 1.3 medium | Qwen3.8 Max (0902) Qwen3.8 Max (0902) medium |
|---|---|---|
| Punktzahl | 8.8 | 8.8 |
| Rang | #37 | #36 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.9 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 84.9% | 83.3% |
| Instabile Tests | 3 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 8.638 | 3.981 |
| Gesamtkosten | $1.469 | $0.677 |
| Eingabepreis | $1.250 / 1M | $2.000 / 1M |
| Ausgabepreis | $4.250 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 89,177 | 96,323 |
| Ausgabe-Token | 11,044 | 5,961 |
| Denk-Token | 308,220 | 74,717 |
| Antwortzeit (Durchschnitt) | 38.57s | 26.01s |
| Antwortzeit (Maximum) | 219.77s | 168.09s |
| Antwortzeit (Gesamt) | 848.59s | 572.19s |
| Parameter | ~1T insgesamt (~50B aktiv) | 2.4T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#37 Muse Spark 1.3
medium- Kosten
- $0.025
- Zeit
- 113.4s
- Token
- 5,952 tok
#36 Qwen3.8 Max (0902)
medium- Kosten
- $0.036
- Zeit
- 108.3s
- Token
- 5,980 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 5.83s | 618 | 448 | 8,507 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.03s | 672 | 295 | 2,003 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 41.14s | 7,275 | 1,182 | 46,737 | |
| Qwen3.8 Max (0902) | 8.4 | 7.4 | 88.9% | 1 | 45.74s | 7,893 | 551 | 20,628 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 7.3 | 5.8 | 83.3% | 1 | 34.71s | 58,867 | 4,645 | 28,798 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 94.38s | 68,852 | 3,895 | 24,303 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 8.75s | 7,155 | 466 | 6,751 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 10.54s | 7,782 | 261 | 2,591 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 3.5 | 4.4 | 33.3% | 2 | 132.33s | 738 | 1,635 | 144,687 | |
| Qwen3.8 Max (0902) | 3.6 | 7.2 | 22.2% | 1 | 49.45s | 780 | 44 | 19,572 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 7.95s | 477 | 236 | 2,303 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 7.56s | 516 | 202 | 689 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 9.8 | 10.0 | 100.0% | 0 | 10.49s | 669 | 319 | 8,140 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.24s | 699 | 90 | 886 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 25.03s | 651 | 640 | 24,761 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.89s | 696 | 353 | 1,599 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 9.6 | 10.0 | 100.0% | 0 | 28.30s | 12,544 | 859 | 8,690 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.93s | 8,229 | 249 | 194 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 | 3.0 | 10.0 | 0.0% | 0 | 85.61s | 183 | 614 | 28,846 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 17.01s | 204 | 21 | 2,252 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.5 Flash LitehighvsMuse Spark 1.3mediumGemini 3.5 FlashlowvsQwen3.8 Max (0902)mediumClaude Opus 5lowvsMuse Spark 1.3mediumGemini 3.5 Flash LitehighvsQwen3.8 Max (0902)mediumGemini 3.6 FlashlowvsMuse Spark 1.3mediumMuse Spark 1.3mediumvsGLM 5.3 FlashmaxGemini 3.5 FlashlowvsMuse Spark 1.3mediumClaude Opus 5lowvsQwen3.8 Max (0902)mediumGemini 3.6 FlashlowvsQwen3.8 Max (0902)mediumQwen3.8 Max (0902)mediumvsGLM 5.3 FlashmaxSeed 2.1 TurbohighvsQwen3.8 Max (0902)mediumMuse Spark 1.3highvsQwen3.8 Max (0902)medium