#68 Gemini 3 Flash Preview
low- Kosten
- $0.007
- Zeit
- 12.1s
- Token
- 2,289 tok
AI BENCHY Compare
Zusammenfassung
GPT-5.4 Nano (medium) führt beim Durchschnittsscore mit 7.5 vs 7.4. GPT-5.4 Nano (medium) hat die niedrigeren Benchmark-Kosten mit $0.107 vs $0.111. Gemini 3 Flash Preview (low) ist schneller mit 5.76s vs 11.95s, mit Erfolgsraten von 79.4% vs 63.5%.
Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-07-14
| Metrik | Gemini 3 Flash Preview Gemini 3 Flash Preview low | GPT-5.4 Nano GPT-5.4 Nano medium |
|---|---|---|
| Punktzahl | 7.4 | 7.5 |
| Rang | #68 | #62 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.2 | 8.4 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 79.4% | 63.5% |
| Instabile Tests | 2 | 4 |
| Gesamtläufe | 63 | 63 |
| Kosten pro Ergebnis | 0.689 | 0.969 |
| Gesamtkosten | $0.111 | $0.107 |
| Eingabepreis | $0.500 / 1M | $0.200 / 1M |
| Ausgabepreis | $3.000 / 1M | $1.250 / 1M |
| Gesamte Eingabe-Token | 36,769 | 35,434 |
| Ausgabe-Token | 2,076 | 3,014 |
| Denk-Token | 28,518 | 76,520 |
| Antwortzeit (Durchschnitt) | 5.76s | 11.95s |
| Antwortzeit (Maximum) | 14.72s | 94.06s |
| Antwortzeit (Gesamt) | 120.93s | 250.98s |
Generierungs-Showcase
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 5.8 | 7.2 | 44.4% | 1 | 6.00s | 8,122 | 456 | 7,421 | |
| GPT-5.4 Nano | 6.1 | 4.7 | 66.7% | 2 | 19.12s | 7,305 | 516 | 20,778 |
Vergleichspaar wechseln