#68 Gemini 3 Flash Preview
low- Kosten
- $0.007
- Zeit
- 12.1s
- Token
- 2,289 tok
AI BENCHY Compare
Zusammenfassung
Qwen3.6 Flash (medium) führt beim Durchschnittsscore mit 7.5 vs 7.4. Gemini 3 Flash Preview (low) hat die niedrigeren Benchmark-Kosten mit $0.111 vs $0.288. Gemini 3 Flash Preview (low) ist schneller mit 5.76s vs 19.25s, mit Erfolgsraten von 79.4% vs 71.4%.
Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-07-14
| Metrik | Gemini 3 Flash Preview Gemini 3 Flash Preview low | Qwen3.6 Flash Qwen3.6 Flash medium |
|---|---|---|
| Punktzahl | 7.4 | 7.5 |
| Rang | #68 | #63 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.2 | 8.1 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 79.4% | 71.4% |
| Instabile Tests | 2 | 5 |
| Gesamtläufe | 63 | 63 |
| Kosten pro Ergebnis | 0.689 | 3.030 |
| Gesamtkosten | $0.111 | $0.288 |
| Eingabepreis | $0.500 / 1M | $0.188 / 1M |
| Ausgabepreis | $3.000 / 1M | $1.125 / 1M |
| Gesamte Eingabe-Token | 36,769 | 42,362 |
| Ausgabe-Token | 2,076 | 2,995 |
| Denk-Token | 28,518 | 245,358 |
| Antwortzeit (Durchschnitt) | 5.76s | 19.25s |
| Antwortzeit (Maximum) | 14.72s | 122.87s |
| Antwortzeit (Gesamt) | 120.93s | 404.20s |
Generierungs-Showcase
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 5.8 | 7.2 | 44.4% | 1 | 6.00s | 8,122 | 456 | 7,421 | |
| Qwen3.6 Flash | 5.0 | 5.1 | 44.5% | 2 | 42.85s | 7,895 | 495 | 67,967 |
Vergleichspaar wechseln