- Rang
- #70
- Gesamte Ausgabe-Token
- 919,699
- Antwortzeit (Durchschnitt)
- 61.71s
- Gesamtkosten
- $0.509
Claude Haiku 5.5 (max) vs Gemini 3.7 Flash (low)
Gemini 3.7 Flash (low) führt beim Durchschnittsscore mit 9.4 vs 8.5. Gemini 3.7 Flash (low) hat die niedrigeren Benchmark-Kosten mit $0.183 vs $0.509. Gemini 3.7 Flash (low) ist schneller mit 6.24s vs 61.71s, mit Erfolgsraten von 85.5% vs 95.7%.
Verglichene Modelle
- Rang
- #25
- Gesamte Ausgabe-Token
- 38,453
- Antwortzeit (Durchschnitt)
- 6.24s
- Gesamtkosten
- $0.183
Empfohlenes Modell
Gemini 3.7 Flash (low)
Es hat hier die beste Punktzahl (9.4) und kostet etwa 2.8x weniger als Claude Haiku 5.5 (max).
Detaillierter Vergleich
| Metrik | Claude Haiku 5.5 Claude Haiku 5.5 max | Gemini 3.7 Flash Gemini 3.7 Flash low |
|---|---|---|
| Punktzahl | 8.5 | 9.4 |
| Rang | #70 | #25 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.6 | 9.3 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 85.5% | 95.7% |
| Instabile Tests | 1 | 2 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 2.677 | 0.868 |
| Gesamtkosten | $0.509 | $0.183 |
| Eingabepreis | $0.100 / 1M | $0.750 / 1M |
| Ausgabepreis | $0.500 / 1M | $3.750 / 1M |
| Preis für Cache-Lesen | $0.010 / 1M | $0.075 / 1M |
| Preis für Cache-Schreiben | $0.125 / 1M | $0.042 / 1M |
| Gesamte Eingabe-Token | 487,516 | 188,519 |
| Ausgabe-Token | 10,212 | 7,694 |
| Denk-Token | 909,487 | 30,759 |
| Antwortzeit (Durchschnitt) | 61.71s | 6.24s |
| Antwortzeit (Maximum) | 288.94s | 58.75s |
| Antwortzeit (Gesamt) | 1419.40s | 143.56s |
| Parameter | ~50B | ~500B insgesamt (~20B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#70 Claude Haiku 5.5
max
OpenRouter returned no showcase content (finish_reason: error).
- Kosten
- $0.000
- Zeit
- 164.5s
- Token
- 0 tok
#25 Gemini 3.7 Flash
low- Kosten
- $0.010
- Zeit
- 23.5s
- Token
- 5,210 tok
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 4.7 | 1.6 | 66.7% | 1 | 93.30s | 349,997 | 2,345 | 42,315 | |
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 58.75s | 98,197 | 1,400 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.52s | 858 | 401 | 10,159 | |
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 1.54s | 492 | 99 | 1,398 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.87s | 10,608 | 532 | 125,988 | |
| Gemini 3.7 Flash | 7.6 | 7.2 | 77.8% | 1 | 6.20s | 8,118 | 461 | 11,508 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 148.38s | 99,980 | 4,909 | 215,518 | |
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 13.00s | 66,250 | 4,873 | 8,108 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 11.11s | 10,515 | 311 | 13,476 | |
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.15s | 7,548 | 278 | 1,093 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.3 | 10.0 | 33.3% | 0 | 228.16s | 990 | 18 | 426,269 | |
| Gemini 3.7 Flash | 8.2 | 7.2 | 88.9% | 1 | 3.09s | 642 | 12 | 3,029 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 42.22s | 714 | 250 | 26,083 | |
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.76s | 486 | 81 | 1,043 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.22s | 921 | 99 | 5,965 | |
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.47s | 615 | 72 | 1,778 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 16.54s | 912 | 716 | 29,419 | |
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 1.92s | 558 | 166 | 1,580 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 9.86s | 11,757 | 355 | 3,989 | |
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.10s | 5,457 | 241 | 160 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 3.0 | 10.0 | 0.0% | 0 | 18.80s | 264 | 276 | 10,306 | |
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.92s | 156 | 11 | 1,062 |
Schnellvergleich
Vergleichspaar wechseln
Claude Opus 5highvsGemini 3.7 FlashlowClaude Opus 5mediumvsGemini 3.7 FlashlowClaude Haiku 5.5maxvsQwen3.7 MaxmediumClaude Haiku 5.5maxvsMuse Spark 1.3lowClaude Opus 5.5highvsGemini 3.7 FlashlowClaude Haiku 5.5maxvsGrok 4.6highClaude Haiku 5.5maxvsQwen3.8 2.4T A95BlowClaude Haiku 5.5maxvsGPT-5 MinimediumClaude Haiku 5.5maxvsMuse Glimmer 30BxhighClaude Haiku 5.5maxvsGemini 3.1 Pro PreviewmediumClaude Haiku 5.5maxvsQwen3.8 Max (0902)lowClaude Haiku 5.5maxvsInklinghighKostenlos verfügbar