- Rang
- #41
- Gesamte Ausgabe-Token
- 17,992
- Antwortzeit (Durchschnitt)
- 6.99s
- Gesamtkosten
- $1.121
Claude Opus 5 (low) vs Gemini 3.5 Flash Lite (high)
Der Durchschnittsscore ist mit 8.7 vs 8.8 praktisch gleichauf. Gemini 3.5 Flash Lite (high) hat die niedrigeren Benchmark-Kosten mit $0.540 vs $1.121. Claude Opus 5 (low) ist schneller mit 6.99s vs 10.05s, mit Erfolgsraten von 83.3% vs 83.3%.
Verglichene Modelle
- Rang
- #39
- Gesamte Ausgabe-Token
- 204,625
- Antwortzeit (Durchschnitt)
- 10.05s
- Gesamtkosten
- $0.540
Empfohlenes Modell
Gemini 3.5 Flash Lite (high)
Es hat hier die beste Punktzahl (8.8) und kostet etwa 2.1x weniger als Claude Opus 5 (low).
Detaillierter Vergleich
| Metrik | Claude Opus 5 Claude Opus 5 low | Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite high |
|---|---|---|
| Punktzahl | 8.7 | 8.8 |
| Rang | #41 | #39 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.6 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 83.3% | 83.3% |
| Instabile Tests | 1 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 6.223 | 3.174 |
| Gesamtkosten | $1.121 | $0.540 |
| Eingabepreis | $5.000 / 1M | $0.300 / 1M |
| Ausgabepreis | $25.000 / 1M | $2.500 / 1M |
| Gesamte Eingabe-Token | 134,770 | 93,046 |
| Ausgabe-Token | 13,604 | 5,884 |
| Denk-Token | 4,388 | 198,741 |
| Antwortzeit (Durchschnitt) | 6.99s | 10.05s |
| Antwortzeit (Maximum) | 30.67s | 36.22s |
| Antwortzeit (Gesamt) | 153.80s | 221.06s |
| Parameter | ~5T insgesamt (~500B aktiv) | ~150B insgesamt (~10B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#41 Claude Opus 5
low- Kosten
- $0.062
- Zeit
- 30.2s
- Token
- 2,615 tok
#39 Gemini 3.5 Flash Lite
high- Kosten
- $0.025
- Zeit
- 36.8s
- Token
- 9,964 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 4.32s | 834 | 1,008 | 376 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.96s | 498 | 142 | 7,917 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 7.8 | 7.4 | 77.8% | 1 | 6.70s | 10,590 | 2,442 | 760 | |
| Gemini 3.5 Flash Lite | 8.4 | 7.4 | 88.9% | 1 | 16.58s | 8,130 | 434 | 57,369 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 21.05s | 97,363 | 6,024 | 911 | |
| Gemini 3.5 Flash Lite | 9.9 | 10.0 | 100.0% | 0 | 27.90s | 68,427 | 4,360 | 52,993 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 3.69s | 10,503 | 343 | 79 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 3.17s | 7,362 | 279 | 5,636 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 5.3 | 10.0 | 33.3% | 0 | 8.91s | 972 | 1,928 | 1,479 | |
| Gemini 3.5 Flash Lite | 3.6 | 7.2 | 22.2% | 1 | 23.14s | 656 | 17 | 54,566 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 3.76s | 708 | 293 | 0 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 3.10s | 488 | 81 | 2,124 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 4.13s | 909 | 242 | 146 | |
| Gemini 3.5 Flash Lite | 9.8 | 10.0 | 100.0% | 0 | 2.16s | 625 | 69 | 3,513 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 4.23s | 894 | 607 | 300 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.09s | 572 | 183 | 4,004 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 10.0 | 10.0 | 100.0% | 0 | 9.03s | 11,739 | 354 | 0 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 4.55s | 6,132 | 310 | 2,955 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 | 3.0 | 10.0 | 0.0% | 0 | 6.48s | 258 | 363 | 337 | |
| Gemini 3.5 Flash Lite | 3.0 | 10.0 | 0.0% | 0 | 9.68s | 156 | 9 | 7,664 |
Schnellvergleich
Vergleichspaar wechseln
Claude Opus 4.8mediumvsGemini 3.5 Flash LitehighGemini 3.5 Flash LitehighvsMuse Spark 1.3mediumClaude Opus 5lowvsGLM 5.3 FlashmaxClaude Opus 5lowvsMuse Spark 1.3mediumGemini 3.5 Flash LitehighvsGLM 5.3 FlashmaxGemini 3.5 Flash LitehighvsQwen3.8 Max (0902)mediumClaude Opus 4.7mediumvsGemini 3.5 Flash LitehighClaude Opus 5lowvsQwen3.8 Max (0902)mediumClaude Opus 5lowvsMuse Spark 1.2highClaude Opus 5lowvsMuse Spark 1.2mediumClaude Opus 5lowvsMuse Spark 1.1mediumGemini 3.5 Flash LitehighvsMuse Spark 1.2medium