- Rang
- #18
- Gesamte Ausgabe-Token
- 97,238
- Antwortzeit (Durchschnitt)
- 20.62s
- Gesamtkosten
- $1.352
Gemini 3.1 Pro Preview (medium) vs Muse Spark 1.3 (high)
Gemini 3.1 Pro Preview (medium) führt beim Durchschnittsscore mit 9.2 vs 8.9. Gemini 3.1 Pro Preview (medium) hat die niedrigeren Benchmark-Kosten mit $1.352 vs $1.653. Gemini 3.1 Pro Preview (medium) ist schneller mit 20.62s vs 52.49s, mit Erfolgsraten von 90.9% vs 77.3%.
- Rang
- #31
- Gesamte Ausgabe-Token
- 359,608
- Antwortzeit (Durchschnitt)
- 52.49s
- Gesamtkosten
- $1.653
Empfohlenes Modell
Gemini 3.1 Pro Preview (medium)
Es hat hier die beste Punktzahl (9.2) und antwortet etwa 2.5x schneller als Muse Spark 1.3 (high).
Detaillierter Vergleich
| Metrik | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium | Muse Spark 1.3 Muse Spark 1.3 high |
|---|---|---|
| Punktzahl | 9.2 | 8.9 |
| Rang | #18 | #31 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 10.0 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 90.9% | 77.3% |
| Instabile Tests | 0 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 6.758 | 10.327 |
| Gesamtkosten | $1.352 | $1.653 |
| Eingabepreis | $2.000 / 1M | $1.250 / 1M |
| Ausgabepreis | $12.000 / 1M | $4.250 / 1M |
| Gesamte Eingabe-Token | 92,296 | 99,143 |
| Ausgabe-Token | 5,232 | 12,083 |
| Denk-Token | 92,006 | 347,525 |
| Antwortzeit (Durchschnitt) | 20.62s | 52.49s |
| Antwortzeit (Maximum) | 88.68s | 251.53s |
| Antwortzeit (Gesamt) | 329.94s | 1154.76s |
| Parameter | ~1.2T insgesamt (~20B aktiv) | ~1T insgesamt (~50B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#18 Gemini 3.1 Pro Preview
medium- Kosten
- $0.115
- Zeit
- 87.2s
- Token
- 9,629 tok
#31 Muse Spark 1.3
high- Kosten
- $0.050
- Zeit
- 203.3s
- Token
- 11,679 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 5.71s | 618 | 487 | 8,829 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 51.66s | 7,275 | 1,228 | 64,287 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 55.55s | 68,737 | 5,707 | 46,328 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 7.01s | 7,155 | 491 | 6,758 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 | |
| Muse Spark 1.3 | 2.9 | 7.2 | 11.1% | 1 | 174.56s | 690 | 801 | 114,774 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 | |
| Muse Spark 1.3 | 10.0 | 10.0 | 100.0% | 0 | 9.49s | 477 | 228 | 2,634 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 | |
| Muse Spark 1.3 | 6.5 | 10.0 | 50.0% | 0 | 14.70s | 669 | 353 | 10,553 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 | |
| Muse Spark 1.3 | 8.7 | 7.7 | 88.9% | 1 | 38.42s | 651 | 1,178 | 37,874 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 | |
| Muse Spark 1.3 | 9.6 | 10.0 | 100.0% | 0 | 33.95s | 12,688 | 1,046 | 14,673 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 | |
| Muse Spark 1.3 | 3.0 | 10.0 | 0.0% | 0 | 140.05s | 183 | 564 | 40,815 |
Schnellvergleich
Vergleichspaar wechseln
Muse Spark 1.3highvsGPT-5.3-CodexmediumClaude Opus 5highvsGemini 3.1 Pro PreviewmediumMuse Spark 1.3highvsQwen3.8 MaxmediumMuse Spark 1.3highvsGPT-5.5mediumGemini 3.1 Pro PreviewmediumvsGrok 4.6highGemini 3.5 FlashmediumvsMuse Spark 1.3highGemini 3.1 Pro PreviewmediumvsGPT-5.5lowGemini 3.5 FlashlowvsMuse Spark 1.3highGemini 3.1 Pro PreviewmediumvsGPT-5.6 SolhighMuse Spark 1.3highvsQwen3.7 MaxmediumSeed 2.1 TurbolowvsGemini 3.1 Pro PreviewmediumClaude Opus 4.8mediumvsMuse Spark 1.3high