#102 Gemini 3.1 Flash Lite Preview
none- Biaya
- $0.003
- Waktu
- 4.7s
- Token
- 1,827 tok
AI BENCHY Compare
Ringkasan
GPT-5.3-Codex (medium) unggul dalam skor rata-rata dengan 8.9 vs 6.4. Gemini 3.1 Flash Lite Preview memiliki biaya benchmark lebih rendah di $0.018 vs $0.740. Gemini 3.1 Flash Lite Preview lebih cepat di 1.21s vs 16.22s, dengan tingkat keberhasilan 60.3% vs 82.5%.
Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-14
| Metrik | Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none | GPT-5.3-Codex GPT-5.3-Codex medium |
|---|---|---|
| Skor | 6.4 | 8.9 |
| Peringkat | #102 | #13 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 9.7 | 8.5 |
| Tes benar | ||
| Tingkat lulus per percobaan | 60.3% | 82.5% |
| Tes tidak stabil | 1 | 4 |
| Total Run | 63 | 63 |
| Biaya per hasil | 0.148 | 4.932 |
| Total Biaya | $0.018 | $0.740 |
| Harga input | $0.250 / 1M | $1.750 / 1M |
| Harga output | $1.500 / 1M | $14.000 / 1M |
| Total token input | 37,582 | 34,299 |
| Token output | 5,547 | 2,357 |
| Token penalaran | 0 | 46,189 |
| Waktu respons (rata-rata) | 1.21s | 16.22s |
| Waktu respons (maks) | 3.39s | 100.93s |
| Waktu respons (total) | 25.45s | 340.67s |
Showcase generasi
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 5.5 | 10.0 | 33.3% | 0 | 967ms | 8,128 | 670 | 0 | |
| GPT-5.3-Codex | 10.0 | 10.0 | 100.0% | 0 | 19.50s | 7,302 | 535 | 10,890 |
Ganti Pasangan Perbandingan