- Rang
- #40
- Gesamte Ausgabe-Token
- 51,927
- Antwortzeit (Durchschnitt)
- 12.97s
- Gesamtkosten
- $1.983
Claude Opus 4.8 (medium) vs Gemini 3.5 Flash Lite (high)
Der Durchschnittsscore ist mit 8.8 vs 8.8 praktisch gleichauf. Gemini 3.5 Flash Lite (high) hat die niedrigeren Benchmark-Kosten mit $0.540 vs $1.983. Gemini 3.5 Flash Lite (high) ist schneller mit 10.05s vs 12.97s, mit Erfolgsraten von 83.3% vs 83.3%.
Verglichene Modelle
- Rang
- #39
- Gesamte Ausgabe-Token
- 204,625
- Antwortzeit (Durchschnitt)
- 10.05s
- Gesamtkosten
- $0.540
Empfohlenes Modell
Gemini 3.5 Flash Lite (high)
Es hat hier die beste Punktzahl (8.8) und kostet etwa 3.7x weniger als Claude Opus 4.8 (medium).
Detaillierter Vergleich
| Metrik | Claude Opus 4.8 Claude Opus 4.8 medium | Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite high |
|---|---|---|
| Punktzahl | 8.8 | 8.8 |
| Rang | #40 | #39 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.2 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 83.3% | 83.3% |
| Instabile Tests | 2 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 11.662 | 3.174 |
| Gesamtkosten | $1.983 | $0.540 |
| Eingabepreis | $5.000 / 1M | $0.300 / 1M |
| Ausgabepreis | $25.000 / 1M | $2.500 / 1M |
| Gesamte Eingabe-Token | 138,448 | 93,046 |
| Ausgabe-Token | 40,765 | 5,884 |
| Denk-Token | 11,162 | 198,741 |
| Antwortzeit (Durchschnitt) | 12.97s | 10.05s |
| Antwortzeit (Maximum) | 70.54s | 36.22s |
| Antwortzeit (Gesamt) | 285.29s | 221.06s |
| Parameter | ~5T insgesamt (~500B aktiv) | ~150B insgesamt (~10B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#40 Claude Opus 4.8
medium- Kosten
- $0.057
- Zeit
- 23.1s
- Token
- 2,412 tok
#39 Gemini 3.5 Flash Lite
high- Kosten
- $0.025
- Zeit
- 36.8s
- Token
- 9,964 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 10.0 | 10.0 | 100.0% | 0 | 3.95s | 834 | 1,179 | 478 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.96s | 498 | 142 | 7,917 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 10.0 | 10.0 | 100.0% | 0 | 15.33s | 10,590 | 9,945 | 1,381 | |
| Gemini 3.5 Flash Lite | 8.4 | 7.4 | 88.9% | 1 | 16.58s | 8,130 | 434 | 57,369 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 9.9 | 10.0 | 100.0% | 0 | 54.29s | 101,005 | 19,531 | 4,762 | |
| Gemini 3.5 Flash Lite | 9.9 | 10.0 | 100.0% | 0 | 27.90s | 68,427 | 4,360 | 52,993 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 7.1 | 5.6 | 83.3% | 1 | 12.29s | 10,503 | 481 | 312 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 3.17s | 7,362 | 279 | 5,636 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 3.6 | 7.2 | 22.2% | 1 | 18.11s | 972 | 7,476 | 2,987 | |
| Gemini 3.5 Flash Lite | 3.6 | 7.2 | 22.2% | 1 | 23.14s | 656 | 17 | 54,566 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 10.0 | 10.0 | 100.0% | 0 | 2.46s | 708 | 237 | 0 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 3.10s | 488 | 81 | 2,124 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 10.0 | 10.0 | 100.0% | 0 | 3.32s | 909 | 373 | 320 | |
| Gemini 3.5 Flash Lite | 9.8 | 10.0 | 100.0% | 0 | 2.16s | 625 | 69 | 3,513 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 10.0 | 10.0 | 100.0% | 0 | 3.95s | 894 | 791 | 483 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.09s | 572 | 183 | 4,004 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 10.0 | 10.0 | 100.0% | 0 | 8.96s | 11,775 | 301 | 225 | |
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 4.55s | 6,132 | 310 | 2,955 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 | 3.0 | 10.0 | 0.0% | 0 | 6.14s | 258 | 451 | 214 | |
| Gemini 3.5 Flash Lite | 3.0 | 10.0 | 0.0% | 0 | 9.68s | 156 | 9 | 7,664 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.5 Flash LitehighvsMuse Spark 1.3mediumClaude Opus 5lowvsGemini 3.5 Flash LitehighClaude Opus 4.8mediumvsGemini 3.6 FlashlowClaude Opus 4.8mediumvsGLM 5.3 FlashmaxGemini 3.5 Flash LitehighvsGLM 5.3 FlashmaxGemini 3.5 Flash LitehighvsQwen3.8 Max (0902)mediumClaude Opus 4.7mediumvsGemini 3.5 Flash LitehighClaude Opus 4.8mediumvsGemini 3.5 FlashlowClaude Opus 4.8mediumvsMuse Spark 1.2highGemini 3.5 Flash LitehighvsMuse Spark 1.2mediumGemini 3.5 Flash LitehighvsMuse Spark 1.1mediumClaude Fable 5mediumvsGemini 3.5 Flash Litehigh