Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs Google: Gemini 3.5 Flash

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-05-19

Metrik Gemini 3.5 Flash Gemini 3.5 Flash high Rilis: 2026-05-19 Gemini 3.5 Flash Gemini 3.5 Flash low Rilis: 2026-05-19
Skor 9.6 9.6
Peringkat #4 #2
Keandalan 10.0 10.0
Konsistensi 9.6 10.0
Tes benar
Tingkat lulus per percobaan 96.5% 94.7%
Tes tidak stabil 1 0
Total Run 57 57
Biaya per hasil 4.294 1.359
Total Biaya $0.773 $0.245
Harga input $1.500 / 1M $1.500 / 1M
Harga output $9.000 / 1M $9.000 / 1M
Token output 1,945 2,003
Token penalaran 78,877 20,245
Waktu respons (rata-rata) 6.90s 2.84s
Waktu respons (maks) 22.37s 6.44s
Waktu respons (total) 131.10s 54.00s

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.57s 174 4,997
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 209 2,536
Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 10.0 10.0 100.0% 0 14.42s 426 10,368
Gemini 3.5 Flash 10.0 10.0 100.0% 0 5.49s 428 3,146
Gabungan Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.37s 351 16,323
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 351 3,050
Parsing dan ekstraksi data Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.43s 279 8,466
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 279 1,164
Spesifik domain Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 7.6 7.2 77.8% 1 14.09s 12 24,721
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 12 4,538
Kecerdasan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.63s 115 1,650
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 119 916
Kepatuhan instruksi Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.35s 70 3,799
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 71 1,652
Pemecahan teka-teki Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.23s 241 4,940
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 288 2,150
Pemanggilan alat Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 9.8 10.0 100.0% 0 4.96s 265 1,608
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 234 403
Pengetahuan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.94s 12 2,005
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 12 690

Perbandingan Cepat

Ganti Pasangan Perbandingan