#68 Gemini 3 Flash Preview
low- Kosten
- $0.007
- Zeit
- 12.1s
- Token
- 2,289 tok
AI BENCHY Compare
Zusammenfassung
GPT-5.3 Chat führt beim Durchschnittsscore mit 7.5 vs 7.4. Gemini 3 Flash Preview (low) hat die niedrigeren Benchmark-Kosten mit $0.111 vs $0.433. Gemini 3 Flash Preview (low) ist schneller mit 5.76s vs 6.34s, mit Erfolgsraten von 79.4% vs 66.7%.
Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-07-14
| Metrik | Gemini 3 Flash Preview Gemini 3 Flash Preview low | GPT-5.3 Chat GPT-5.3 Chat none |
|---|---|---|
| Punktzahl | 7.4 | 7.5 |
| Rang | #68 | #61 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.2 | 8.1 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 79.4% | 66.7% |
| Instabile Tests | 2 | 5 |
| Gesamtläufe | 63 | 63 |
| Kosten pro Ergebnis | 0.689 | 3.605 |
| Gesamtkosten | $0.111 | $0.433 |
| Eingabepreis | $0.500 / 1M | $1.750 / 1M |
| Ausgabepreis | $3.000 / 1M | $14.000 / 1M |
| Gesamte Eingabe-Token | 36,769 | 34,209 |
| Ausgabe-Token | 2,076 | 26,617 |
| Denk-Token | 28,518 | 0 |
| Antwortzeit (Durchschnitt) | 5.76s | 6.34s |
| Antwortzeit (Maximum) | 14.72s | 18.33s |
| Antwortzeit (Gesamt) | 120.93s | 133.13s |
Generierungs-Showcase
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 5.8 | 7.2 | 44.4% | 1 | 6.00s | 8,122 | 456 | 7,421 | |
| GPT-5.3 Chat | 5.6 | 4.7 | 55.6% | 2 | 10.52s | 7,302 | 6,632 | 0 |
Vergleichspaar wechseln