- Rang
- #128
- Gesamte Ausgabe-Token
- 40,776
- Antwortzeit (Durchschnitt)
- 6.51s
- Gesamtkosten
- $0.185
Gemini 3 Flash Preview (low) vs GPT-5.4 (medium)
GPT-5.4 (medium) führt beim Durchschnittsscore mit 8.5 vs 7.4. Gemini 3 Flash Preview (low) hat die niedrigeren Benchmark-Kosten mit $0.185 vs $1.560. Gemini 3 Flash Preview (low) ist schneller mit 6.51s vs 22.85s, mit Erfolgsraten von 75.8% vs 77.3%.
Verglichene Modelle
- Rang
- #51
- Gesamte Ausgabe-Token
- 90,466
- Antwortzeit (Durchschnitt)
- 22.85s
- Gesamtkosten
- $1.560
Empfohlenes Modell
Gemini 3 Flash Preview (low)
Es bietet den besten Gesamtkompromiss: wettbewerbsfähige Punktzahl (7.4), niedrigere Kosten als GPT-5.4 (medium) und ausgewogene Antwortzeit.
Detaillierter Vergleich
| Metrik | Gemini 3 Flash Preview Gemini 3 Flash Preview low | GPT-5.4 GPT-5.4 medium |
|---|---|---|
| Punktzahl | 7.4 | 8.5 |
| Rang | #128 | #51 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.2 | 8.6 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 75.8% | 77.3% |
| Instabile Tests | 2 | 4 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 1.152 | 10.399 |
| Gesamtkosten | $0.185 | $1.560 |
| Eingabepreis | $0.500 / 1M | $2.500 / 1M |
| Ausgabepreis | $3.000 / 1M | $15.000 / 1M |
| Gesamte Eingabe-Token | 123,687 | 81,136 |
| Ausgabe-Token | 9,572 | 6,155 |
| Denk-Token | 31,204 | 84,311 |
| Antwortzeit (Durchschnitt) | 6.51s | 22.85s |
| Antwortzeit (Maximum) | 17.13s | 100.41s |
| Antwortzeit (Gesamt) | 143.12s | 502.78s |
| Parameter | ~500B insgesamt (~20B aktiv) | ~1.5T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#128 Gemini 3 Flash Preview
low- Kosten
- $0.007
- Zeit
- 12.1s
- Token
- 2,289 tok
#51 GPT-5.4
medium- Kosten
- $0.214
- Zeit
- 199.6s
- Token
- 14,349 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 3.48s | 500 | 281 | 3,082 | |
| GPT-5.4 | 8.3 | 10.0 | 75.0% | 0 | 4.11s | 606 | 240 | 1,511 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 5.8 | 7.2 | 44.4% | 1 | 6.00s | 8,122 | 456 | 7,421 | |
| GPT-5.4 | 8.8 | 7.8 | 88.9% | 1 | 44.36s | 7,305 | 433 | 24,216 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 3.0 | 10.0 | 0.0% | 0 | 10.20s | 99,775 | 7,822 | 0 | |
| GPT-5.4 | 10.0 | 10.0 | 100.0% | 0 | 29.77s | 58,038 | 4,214 | 13,351 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 9.40s | 7,261 | 279 | 3,656 | |
| GPT-5.4 | 10.0 | 10.0 | 100.0% | 0 | 5.32s | 7,140 | 234 | 804 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 5.3 | 7.2 | 44.4% | 1 | 9.74s | 648 | 12 | 9,096 | |
| GPT-5.4 | 5.3 | 7.2 | 44.4% | 1 | 72.44s | 628 | 61 | 36,544 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 3.68s | 492 | 120 | 981 | |
| GPT-5.4 | 4.7 | 3.1 | 33.3% | 1 | 4.92s | 477 | 145 | 321 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 9.9 | 10.0 | 100.0% | 0 | 7.02s | 621 | 71 | 2,752 | |
| GPT-5.4 | 10.0 | 10.0 | 100.0% | 0 | 3.11s | 660 | 93 | 897 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 5.77s | 562 | 288 | 3,168 | |
| GPT-5.4 | 8.2 | 7.2 | 88.9% | 1 | 9.14s | 642 | 441 | 3,815 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 4.99s | 5,550 | 234 | 415 | |
| GPT-5.4 | 10.0 | 10.0 | 100.0% | 0 | 13.28s | 5,445 | 264 | 1,031 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 2.75s | 156 | 9 | 633 | |
| GPT-5.4 | 3.0 | 10.0 | 0.0% | 0 | 13.95s | 195 | 30 | 1,821 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3 Flash PreviewlowvsMiMo-V2.6-FlashmediumGemini 3 Flash PreviewlowvsQwen3.8 2.4T A95BhighClaude Sonnet 4.6nonevsGemini 3 Flash PreviewlowGPT-5.4mediumvsQwen3.8 MaxlowGemini 3 Flash PreviewlowvsGLM 5.3highGemini 3 Flash PreviewlowvsLongCat 2.0mediumDeepSeek V4.1 FlashlowvsGPT-5.4mediumDeepSeek V4.1 FlashhighvsGPT-5.4mediumGemini 3 Flash PreviewlowvsGPT-5.6 LunamediumGemini 3 Flash PreviewlowvsKimi K2.7 CodemediumGemini 3 Flash PreviewlowvsQwen3.7 MaxnoneGemini 3 Flash PreviewlowvsGLM 5.3 Flashhigh