- Rang
- #159
- Gesamte Ausgabe-Token
- 42,315
- Antwortzeit (Durchschnitt)
- 16.44s
- Gesamtkosten
- $0.781
Grok 4.6 (low) vs MiMo-V2.5 (medium)
MiMo-V2.5 (medium) führt beim Durchschnittsscore mit 7.1 vs 6.9. MiMo-V2.5 (medium) hat die niedrigeren Benchmark-Kosten mit $0.419 vs $0.781. Grok 4.6 (low) ist schneller mit 16.44s vs 49.20s, mit Erfolgsraten von 66.7% vs 69.6%.
Verglichene Modelle
- Rang
- #152
- Gesamte Ausgabe-Token
- 341,511
- Antwortzeit (Durchschnitt)
- 49.20s
- Gesamtkosten
- $0.419
Empfohlenes Modell
MiMo-V2.5 (medium)
Es hat hier die beste Punktzahl (7.1) und kostet etwa 1.9x weniger als Grok 4.6 (low).
Detaillierter Vergleich
| Metrik | Grok 4.6 Grok 4.6 low | MiMo-V2.5 MiMo-V2.5 medium |
|---|---|---|
| Punktzahl | 6.9 | 7.1 |
| Rang | #159 | #152 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.6 | 7.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 66.7% | 69.6% |
| Instabile Tests | 1 | 7 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 5.205 | 3.491 |
| Gesamtkosten | $0.781 | $0.419 |
| Eingabepreis | $2.000 / 1M | $0.140 / 1M |
| Ausgabepreis | $6.000 / 1M | $0.280 / 1M |
| Gesamte Eingabe-Token | 263,427 | 259,664 |
| Ausgabe-Token | 6,006 | 8,414 |
| Denk-Token | 36,309 | 333,097 |
| Antwortzeit (Durchschnitt) | 16.44s | 49.20s |
| Antwortzeit (Maximum) | 57.97s | 316.27s |
| Antwortzeit (Gesamt) | 378.14s | 1131.69s |
| Parameter | ~1.7T insgesamt (~170B aktiv) | 310B insgesamt (15B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#159 SpaceXAI: Grok 4.6
low- Kosten
- $0.011
- Zeit
- 26.0s
- Token
- 1,941 tok
#152 MiMo-V2.5
medium- Kosten
- $0.002
- Zeit
- 54.8s
- Token
- 5,247 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
Schnellvergleich
Vergleichspaar wechseln
Qwen3.5-122B-A10BmediumvsGrok 4.6lowGPT-5.2 ChatnonevsMiMo-V2.5mediumKimi K2.7 CodemediumvsGrok 4.6lowGemini 3.1 Flash Lite PreviewmediumvsGrok 4.6lowGemini 3.1 Flash LitemediumvsGrok 4.6lowEmber-1highvsGrok 4.6lowGPT-5.2 ChatnonevsGrok 4.6lowEmber-1lowvsMiMo-V2.5mediumGemma 4 31BmediumKostenlos verfügbarvsGrok 4.6lowClaude Opus 5nonevsMiMo-V2.5mediumClaude Opus 4.8nonevsGrok 4.6lowGemini 3 Flash PreviewlowvsMiMo-V2.5medium