- Rang
- #70
- Gesamte Ausgabe-Token
- 919,699
- Antwortzeit (Durchschnitt)
- 61.71s
- Gesamtkosten
- $0.509
Claude Haiku 5.5 (max) vs Gemini 3.1 Pro Preview (medium)
Claude Haiku 5.5 (max) führt beim Durchschnittsscore mit 8.5 vs 8.4. Claude Haiku 5.5 (max) hat die niedrigeren Benchmark-Kosten mit $0.509 vs $1.585. Gemini 3.1 Pro Preview (medium) ist schneller mit 22.71s vs 61.71s, mit Erfolgsraten von 85.5% vs 89.9%.
Verglichene Modelle
- Rang
- #74
- Gesamte Ausgabe-Token
- 102,691
- Antwortzeit (Durchschnitt)
- 22.71s
- Gesamtkosten
- $1.585
Empfohlenes Modell
Claude Haiku 5.5 (max)
Es hat hier die beste Punktzahl (8.5) und kostet etwa 3.1x weniger als Gemini 3.1 Pro Preview (medium).
Detaillierter Vergleich
| Metrik | Claude Haiku 5.5 Claude Haiku 5.5 max | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium |
|---|---|---|
| Punktzahl | 8.5 | 8.4 |
| Rang | #70 | #74 |
| Zuverlässigkeit | 10.0 | 9.8 |
| Konsistenz | 9.6 | 9.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 85.5% | 89.9% |
| Instabile Tests | 1 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 2.677 | 7.924 |
| Gesamtkosten | $0.509 | $1.585 |
| Eingabepreis | $0.100 / 1M | $2.000 / 1M |
| Ausgabepreis | $0.500 / 1M | $12.000 / 1M |
| Preis für Cache-Lesen | $0.010 / 1M | $0.200 / 1M |
| Preis für Cache-Schreiben | $0.125 / 1M | $0.375 / 1M |
| Gesamte Eingabe-Token | 487,516 | 176,208 |
| Ausgabe-Token | 10,212 | 6,093 |
| Denk-Token | 909,487 | 96,598 |
| Antwortzeit (Durchschnitt) | 61.71s | 22.71s |
| Antwortzeit (Maximum) | 288.94s | 88.68s |
| Antwortzeit (Gesamt) | 1419.40s | 386.11s |
| Parameter | ~50B | ~1.2T insgesamt (~20B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#70 Claude Haiku 5.5
max
OpenRouter returned no showcase content (finish_reason: error).
- Kosten
- $0.000
- Zeit
- 164.5s
- Token
- 0 tok
#74 Gemini 3.1 Pro Preview
medium- Kosten
- $0.115
- Zeit
- 87.2s
- Token
- 9,629 tok
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 4.7 | 1.6 | 66.7% | 1 | 93.30s | 349,997 | 2,345 | 42,315 | |
| Gemini 3.1 Pro Preview | 4.7 | 1.6 | 66.7% | 1 | 56.17s | 83,912 | 861 | 4,592 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.52s | 858 | 401 | 10,159 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.87s | 10,608 | 532 | 125,988 | |
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 148.38s | 99,980 | 4,909 | 215,518 | |
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 11.11s | 10,515 | 311 | 13,476 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.3 | 10.0 | 33.3% | 0 | 228.16s | 990 | 18 | 426,269 | |
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 42.22s | 714 | 250 | 26,083 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.22s | 921 | 99 | 5,965 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 16.54s | 912 | 716 | 29,419 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 9.86s | 11,757 | 355 | 3,989 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 3.0 | 10.0 | 0.0% | 0 | 18.80s | 264 | 276 | 10,306 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.1 Pro PreviewmediumvsInklinghighKostenlos verfügbarGemini 3.1 Pro PreviewmediumvsMuse Glimmer 30BxhighGemini 3.1 Pro PreviewmediumvsMuse Spark 1.1highClaude Haiku 5.5maxvsQwen3.7 MaxmediumGemini 3.1 Pro PreviewmediumvsQwen3.8 2.4T A95BlowClaude Haiku 5.5maxvsMuse Spark 1.3lowDeepSeek V4 Flash 0731highvsGemini 3.1 Pro PreviewmediumClaude Haiku 5.5maxvsGrok 4.6highClaude Haiku 5.5maxvsQwen3.8 2.4T A95BlowGemini 3.1 Pro PreviewmediumvsGLM 5.2highClaude Haiku 5.5maxvsGPT-5 MinimediumClaude Haiku 5.5maxvsMuse Glimmer 30Bxhigh