Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs OpenAI: GPT-5.4

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-06-03

Metrik Gemini 3 Flash Preview Gemini 3 Flash Preview low Rilis: 2025-12-17 GPT-5.4 GPT-5.4 medium Rilis: 2026-03-05
Skor 8.6 7.9
Peringkat #12 #27
Keandalan 10.0 10.0
Konsistensi 9.6 8.5
Tes benar
Tingkat lulus per percobaan 81.7% 75.0%
Tes tidak stabil 1 4
Total Run 60 60
Biaya per hasil 0.658 8.765
Total Biaya $0.106 $1.140
Harga input $0.500 / 1M $2.500 / 1M
Harga output $3.000 / 1M $15.000 / 1M
Total token input 33,766 31,489
Token output 2,070 2,221
Token penalaran 27,348 68,486
Waktu respons (rata-rata) 5.81s 22.31s
Waktu respons (maks) 14.72s 100.41s
Waktu respons (total) 116.25s 446.17s

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.48s 500 281 3,082
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 7.3 10.0 50.0% 0 6.66s 5,119 450 6,251
GPT-5.4 8.2 6.7 83.3% 1 54.98s 4,686 412 19,995
Gabungan Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 3.27s 12,860 326 0
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
Parsing dan ekstraksi data Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 9.40s 7,261 279 3,656
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
Spesifik domain Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 5.3 7.2 44.4% 1 8.05s 645 12 6,410
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Kecerdasan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.68s 492 120 981
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
Kepatuhan instruksi Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 9.9 10.0 100.0% 0 7.02s 621 71 2,752
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
Pemecahan teka-teki Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.77s 562 288 3,168
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
Pemanggilan alat Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.99s 5,550 234 415
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
Pengetahuan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 2.75s 156 9 633
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

Perbandingan Cepat

Ganti Pasangan Perbandingan