- Rang
- #70
- Gesamte Ausgabe-Token
- 919,699
- Antwortzeit (Durchschnitt)
- 61.71s
- Gesamtkosten
- $0.509
Claude Haiku 5.5 (max) vs GPT-6.1 Sol (low)
GPT-6.1 Sol (low) führt beim Durchschnittsscore mit 9.6 vs 8.5. GPT-6.1 Sol (low) hat die niedrigeren Benchmark-Kosten mit $0.460 vs $0.509. GPT-6.1 Sol (low) ist schneller mit 7.15s vs 61.71s, mit Erfolgsraten von 85.5% vs 92.8%.
Verglichene Modelle
- Rang
- #16
- Gesamte Ausgabe-Token
- 13,138
- Antwortzeit (Durchschnitt)
- 7.15s
- Gesamtkosten
- $0.460
Empfohlenes Modell
GPT-6.1 Sol (low)
Es hat hier die beste Punktzahl (9.6) und antwortet etwa 8.6x schneller als Claude Haiku 5.5 (max).
Detaillierter Vergleich
| Metrik | Claude Haiku 5.5 Claude Haiku 5.5 max | GPT-6.1 Sol GPT-6.1 Sol low |
|---|---|---|
| Punktzahl | 8.5 | 9.6 |
| Rang | #70 | #16 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.6 | 9.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 85.5% | 92.8% |
| Instabile Tests | 1 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 2.677 | 2.187 |
| Gesamtkosten | $0.509 | $0.460 |
| Eingabepreis | $0.100 / 1M | $2.000 / 1M |
| Ausgabepreis | $0.500 / 1M | $10.000 / 1M |
| Preis für Cache-Lesen | $0.010 / 1M | $0.100 / 1M |
| Preis für Cache-Schreiben | $0.125 / 1M | $2.500 / 1M |
| Gesamte Eingabe-Token | 487,516 | 163,900 |
| Ausgabe-Token | 10,212 | 4,958 |
| Denk-Token | 909,487 | 8,180 |
| Antwortzeit (Durchschnitt) | 61.71s | 7.15s |
| Antwortzeit (Maximum) | 288.94s | 46.57s |
| Antwortzeit (Gesamt) | 1419.40s | 164.47s |
| Parameter | ~50B | ~2T insgesamt (~150B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#70 Claude Haiku 5.5
max
OpenRouter returned no showcase content (finish_reason: error).
- Kosten
- $0.000
- Zeit
- 164.5s
- Token
- 0 tok
#16 GPT-6.1 Sol
low- Kosten
- $0.028
- Zeit
- 44.6s
- Token
- 2,881 tok
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 4.7 | 1.6 | 66.7% | 1 | 93.30s | 349,997 | 2,345 | 42,315 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 46.57s | 85,882 | 798 | 461 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.52s | 858 | 401 | 10,159 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.14s | 606 | 147 | 226 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.87s | 10,608 | 532 | 125,988 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 4.48s | 7,302 | 388 | 1,286 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 148.38s | 99,980 | 4,909 | 215,518 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 10.94s | 54,810 | 2,619 | 370 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 11.11s | 10,515 | 311 | 13,476 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 1.94s | 7,140 | 222 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.3 | 10.0 | 33.3% | 0 | 228.16s | 990 | 18 | 426,269 | |
| GPT-6.1 Sol | 7.7 | 10.0 | 66.7% | 0 | 15.39s | 732 | 69 | 5,195 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 42.22s | 714 | 250 | 26,083 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 3.66s | 477 | 114 | 142 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.22s | 921 | 99 | 5,965 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.21s | 660 | 93 | 115 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 16.54s | 912 | 716 | 29,419 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.19s | 642 | 232 | 88 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 9.86s | 11,757 | 355 | 3,989 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 5.53s | 5,454 | 246 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 3.0 | 10.0 | 0.0% | 0 | 18.80s | 264 | 276 | 10,306 | |
| GPT-6.1 Sol | 2.8 | 1.6 | 33.3% | 1 | 3.80s | 195 | 30 | 297 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3 Flash PreviewmediumvsGPT-6.1 SollowClaude Haiku 5.5maxvsQwen3.7 MaxmediumClaude Haiku 5.5maxvsMuse Spark 1.3lowGemini 3.7 FlashmediumvsGPT-6.1 SollowClaude Haiku 5.5maxvsGrok 4.6highClaude Haiku 5.5maxvsQwen3.8 2.4T A95BlowClaude Haiku 5.5maxvsGPT-5 MinimediumClaude Haiku 5.5maxvsMuse Glimmer 30BxhighClaude Haiku 5.5maxvsGemini 3.1 Pro PreviewmediumClaude Haiku 5.5maxvsQwen3.8 Max (0902)lowClaude Haiku 5.5maxvsInklinghighKostenlos verfügbarClaude Haiku 5.5maxvsMuse Spark 1.1high