- Rang
- #80
- Gesamte Ausgabe-Token
- 105,640
- Antwortzeit (Durchschnitt)
- 10.41s
- Gesamtkosten
- $0.088
Claude Haiku 5.5 (high) vs Gemini 3.1 Pro Preview (medium)
Gemini 3.1 Pro Preview (medium) führt beim Durchschnittsscore mit 8.4 vs 8.3. Claude Haiku 5.5 (high) hat die niedrigeren Benchmark-Kosten mit $0.088 vs $1.585. Claude Haiku 5.5 (high) ist schneller mit 10.41s vs 22.71s, mit Erfolgsraten von 76.8% vs 89.9%.
Verglichene Modelle
- Rang
- #74
- Gesamte Ausgabe-Token
- 102,691
- Antwortzeit (Durchschnitt)
- 22.71s
- Gesamtkosten
- $1.585
Empfohlenes Modell
Claude Haiku 5.5 (high)
Die Punktzahl bleibt nah an der besten hier (8.3 vs 8.4) und es kostet etwa 18.1x weniger als Gemini 3.1 Pro Preview (medium).
Detaillierter Vergleich
| Metrik | Claude Haiku 5.5 Claude Haiku 5.5 high | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium |
|---|---|---|
| Punktzahl | 8.3 | 8.4 |
| Rang | #80 | #74 |
| Zuverlässigkeit | 10.0 | 9.8 |
| Konsistenz | 8.5 | 9.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 76.8% | 89.9% |
| Instabile Tests | 4 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 0.584 | 7.924 |
| Gesamtkosten | $0.088 | $1.585 |
| Eingabepreis | $0.100 / 1M | $2.000 / 1M |
| Ausgabepreis | $0.500 / 1M | $12.000 / 1M |
| Preis für Cache-Lesen | $0.010 / 1M | $0.200 / 1M |
| Preis für Cache-Schreiben | $0.125 / 1M | $0.375 / 1M |
| Gesamte Eingabe-Token | 346,451 | 176,208 |
| Ausgabe-Token | 10,136 | 6,093 |
| Denk-Token | 95,504 | 96,598 |
| Antwortzeit (Durchschnitt) | 10.41s | 22.71s |
| Antwortzeit (Maximum) | 52.61s | 88.68s |
| Antwortzeit (Gesamt) | 239.38s | 386.11s |
| Parameter | ~50B | ~1.2T insgesamt (~20B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#80 Claude Haiku 5.5
high- Kosten
- $0.003
- Zeit
- 28.0s
- Token
- 5,775 tok
#74 Gemini 3.1 Pro Preview
medium- Kosten
- $0.115
- Zeit
- 87.2s
- Token
- 9,629 tok
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 52.61s | 206,189 | 2,382 | 10,134 | |
| Gemini 3.1 Pro Preview | 4.7 | 1.6 | 66.7% | 1 | 56.17s | 83,912 | 861 | 4,592 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 2.70s | 858 | 551 | 2,399 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 6.0 | 7.2 | 55.6% | 1 | 9.54s | 10,608 | 503 | 16,741 | |
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 30.00s | 102,723 | 4,896 | 29,883 | |
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 3.77s | 10,515 | 312 | 2,031 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 4.1 | 4.4 | 44.5% | 2 | 16.29s | 990 | 65 | 25,349 | |
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 4.89s | 714 | 208 | 1,603 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 9.9 | 10.0 | 100.0% | 0 | 3.19s | 921 | 99 | 1,723 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.9 | 7.2 | 55.6% | 1 | 3.28s | 912 | 615 | 3,202 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.34s | 11,757 | 354 | 849 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 3.0 | 10.0 | 0.0% | 0 | 4.49s | 264 | 151 | 1,590 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 |
Schnellvergleich
Vergleichspaar wechseln
Claude Haiku 5.5highvsKimi K3maxGemini 3.1 Pro PreviewmediumvsInklinghighKostenlos verfügbarGemini 3.1 Pro PreviewmediumvsMuse Glimmer 30BxhighGemini 3.1 Pro PreviewmediumvsMuse Spark 1.1highGemini 3.1 Pro PreviewmediumvsQwen3.8 2.4T A95BlowDeepSeek V4 Flash 0731highvsGemini 3.1 Pro PreviewmediumClaude Haiku 5.5highvsGPT-6 LunamediumGemini 3.1 Pro PreviewmediumvsGLM 5.2highClaude Haiku 5.5highvsLing 3.1 FlashmediumClaude Haiku 5.5highvsQwen3.7 PlusmediumClaude Haiku 5.5maxvsGemini 3.1 Pro PreviewmediumClaude Haiku 5.5highvsGLM 5.2medium