- Rang
- #70
- Gesamte Ausgabe-Token
- 919,699
- Antwortzeit (Durchschnitt)
- 61.71s
- Gesamtkosten
- $0.509
Claude Haiku 5.5 (max) vs Muse Glimmer 30B (xhigh)
Claude Haiku 5.5 (max) führt beim Durchschnittsscore mit 8.5 vs 8.4. Claude Haiku 5.5 (max) hat die niedrigeren Benchmark-Kosten mit $0.509 vs $0.585. Claude Haiku 5.5 (max) ist schneller mit 61.71s vs 97.70s, mit Erfolgsraten von 85.5% vs 71.0%.
Verglichene Modelle
- Rang
- #73
- Gesamte Ausgabe-Token
- 415,435
- Antwortzeit (Durchschnitt)
- 97.70s
- Gesamtkosten
- $0.585
Empfohlenes Modell
Claude Haiku 5.5 (max)
Es hat hier die beste Punktzahl (8.5) und antwortet etwa 1.6x schneller als Muse Glimmer 30B (xhigh).
Detaillierter Vergleich
| Metrik | Claude Haiku 5.5 Claude Haiku 5.5 max | Muse Glimmer 30B Muse Glimmer 30B xhigh |
|---|---|---|
| Punktzahl | 8.5 | 8.4 |
| Rang | #70 | #73 |
| Zuverlässigkeit | 10.0 | 9.9 |
| Konsistenz | 9.6 | 8.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 85.5% | 71.0% |
| Instabile Tests | 1 | 4 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 2.677 | 5.170 |
| Gesamtkosten | $0.509 | $0.585 |
| Eingabepreis | $0.100 / 1M | $0.300 / 1M |
| Ausgabepreis | $0.500 / 1M | $1.200 / 1M |
| Preis für Cache-Lesen | $0.010 / 1M | $0.040 / 1M |
| Preis für Cache-Schreiben | $0.125 / 1M | k. A. |
| Gesamte Eingabe-Token | 487,516 | 287,538 |
| Ausgabe-Token | 10,212 | 118,266 |
| Denk-Token | 909,487 | 346,758 |
| Antwortzeit (Durchschnitt) | 61.71s | 97.70s |
| Antwortzeit (Maximum) | 288.94s | 576.79s |
| Antwortzeit (Gesamt) | 1419.40s | 2247.18s |
| Parameter | ~50B | 30B |
| Verfügbarkeit | Geschlossen | Open Source |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#70 Claude Haiku 5.5
max
OpenRouter returned no showcase content (finish_reason: error).
- Kosten
- $0.000
- Zeit
- 164.5s
- Token
- 0 tok
#73 Muse Glimmer 30B
xhigh- Kosten
- $0.007
- Zeit
- 94.6s
- Token
- 4,318 tok
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 4.7 | 1.6 | 66.7% | 1 | 93.30s | 349,997 | 2,345 | 42,315 | |
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 145.06s | 176,608 | 1,893 | 16,287 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.52s | 858 | 401 | 10,159 | |
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 13.01s | 822 | 9,982 | 12,542 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.87s | 10,608 | 532 | 125,988 | |
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 105.91s | 7,428 | 18,697 | 63,334 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 148.38s | 99,980 | 4,909 | 215,518 | |
| Muse Glimmer 30B | 6.0 | 2.7 | 66.7% | 2 | 272.74s | 82,932 | 21,229 | 77,043 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 11.11s | 10,515 | 311 | 13,476 | |
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 19.84s | 7,071 | 6,535 | 10,689 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.3 | 10.0 | 33.3% | 0 | 228.16s | 990 | 18 | 426,269 | |
| Muse Glimmer 30B | 2.9 | 7.2 | 11.1% | 1 | 142.55s | 894 | 43,561 | 77,204 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 42.22s | 714 | 250 | 26,083 | |
| Muse Glimmer 30B | 5.5 | 10.0 | 0.0% | 0 | 7.41s | 528 | 1,928 | 2,060 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.22s | 921 | 99 | 5,965 | |
| Muse Glimmer 30B | 8.4 | 6.9 | 83.3% | 1 | 8.90s | 771 | 2,420 | 4,507 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 16.54s | 912 | 716 | 29,419 | |
| Muse Glimmer 30B | 7.8 | 9.3 | 66.7% | 0 | 199.67s | 695 | 10,241 | 60,935 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 9.86s | 11,757 | 355 | 3,989 | |
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 8.08s | 9,555 | 383 | 1,566 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 3.0 | 10.0 | 0.0% | 0 | 18.80s | 264 | 276 | 10,306 | |
| Muse Glimmer 30B | 3.0 | 10.0 | 0.0% | 0 | 87.23s | 234 | 1,397 | 20,591 |
Schnellvergleich
Vergleichspaar wechseln
Muse Glimmer 30BxhighvsGPT-5 MinimediumMuse Glimmer 30BxhighvsQwen3.8 2.4T A95BlowGemini 3.1 Pro PreviewmediumvsMuse Glimmer 30BxhighClaude Haiku 5.5maxvsQwen3.7 MaxmediumClaude Haiku 5.5maxvsMuse Spark 1.3lowMuse Glimmer 30BxhighvsInklinghighKostenlos verfügbarClaude Haiku 5.5maxvsGrok 4.6highDeepSeek V4 Flash 0731highvsMuse Glimmer 30BxhighClaude Haiku 5.5maxvsQwen3.8 2.4T A95BlowClaude Haiku 5.5maxvsGPT-5 MinimediumMuse Glimmer 30BxhighvsGLM 5.2highClaude Haiku 5.5maxvsGemini 3.1 Pro Previewmedium