- Peringkat
- #77
- Total token output
- 246,012
- Waktu respons (rata-rata)
- 18.59s
- Total Biaya
- $2.737
Gemini 3.5 Flash (high) vs GPT-5 Mini (medium)
GPT-5 Mini (medium) unggul dalam skor rata-rata dengan 8.4 vs 8.3. GPT-5 Mini (medium) memiliki biaya benchmark lebih rendah di $0.293 vs $2.737. Gemini 3.5 Flash (high) lebih cepat di 18.59s vs 29.42s, dengan tingkat keberhasilan 85.5% vs 66.7%.
Model yang Dibandingkan
- Peringkat
- #69
- Total token output
- 119,211
- Waktu respons (rata-rata)
- 29.42s
- Total Biaya
- $0.293
Model yang direkomendasikan
Gemini 3.5 Flash (high)
Its score stays close to the best score here (8.3 vs 8.4), while responding about 1.6x faster than GPT-5 Mini (medium).
Perbandingan terperinci
| Metrik | Gemini 3.5 Flash Gemini 3.5 Flash high | GPT-5 Mini GPT-5 Mini medium |
|---|---|---|
| Skor | 8.3 | 8.4 |
| Peringkat | #77 | #69 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 9.3 | 8.5 |
| Percobaan | 69/69 | 69/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 85.5% | 66.7% |
| Tes tidak stabil | 2 | 4 |
| Total Run | 69 | 69 |
| Biaya per hasil | 14.402 | 2.247 |
| Total Biaya | $2.737 | $0.293 |
| Harga input | $1.500 / 1M | $0.250 / 1M |
| Harga output | $9.000 / 1M | $2.000 / 1M |
| Total token input | 348,103 | 214,645 |
| Token output | 11,045 | 15,532 |
| Token penalaran | 234,967 | 103,679 |
| Waktu respons (rata-rata) | 18.59s | 29.42s |
| Waktu respons (maks) | 145.92s | 111.48s |
| Waktu respons (total) | 427.52s | 676.56s |
| Parameter | ~500B total (~20B aktif) | ~400B total (~17B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#77 Gemini 3.5 Flash
high- Biaya
- $0.208
- Waktu
- 118.2s
- Token
- 23,158 tok
#69 GPT-5 Mini
medium- Biaya
- $0.007
- Waktu
- 42.9s
- Token
- 3,432 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Tugas agen | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 3.4 | 9.6 | 0.0% | 0 | 87.32s | 240,957 | 2,268 | 38,262 | |
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 68.54s | 116,262 | 1,123 | 10,069 |
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.57s | 492 | 174 | 4,997 | |
| GPT-5 Mini | 7.1 | 7.6 | 66.7% | 1 | 13.86s | 606 | 1,715 | 6,378 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 22.96s | 8,118 | 456 | 47,129 | |
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 27.63s | 7,302 | 658 | 17,152 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 8.2 | 6.9 | 66.7% | 1 | 84.14s | 82,416 | 7,153 | 93,585 | |
| GPT-5 Mini | 7.3 | 5.8 | 83.3% | 1 | 99.82s | 75,392 | 8,387 | 35,328 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 6.43s | 7,548 | 279 | 8,466 | |
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 12.58s | 7,140 | 453 | 3,200 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 5.3 | 7.2 | 44.4% | 1 | 16.99s | 642 | 12 | 28,526 | |
| GPT-5 Mini | 3.5 | 4.4 | 33.3% | 2 | 44.66s | 524 | 268 | 16,128 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.63s | 486 | 115 | 1,650 | |
| GPT-5 Mini | 4.5 | 10.0 | 0.0% | 0 | 13.50s | 477 | 349 | 1,856 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.35s | 615 | 70 | 3,799 | |
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 11.59s | 660 | 310 | 3,968 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.23s | 558 | 241 | 4,940 | |
| GPT-5 Mini | 5.6 | 9.8 | 33.3% | 0 | 15.20s | 642 | 1,622 | 6,144 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 9.8 | 10.0 | 100.0% | 0 | 4.96s | 6,115 | 265 | 1,608 | |
| GPT-5 Mini | 10.0 | 10.0 | 100.0% | 0 | 18.64s | 5,445 | 487 | 1,600 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.94s | 156 | 12 | 2,005 | |
| GPT-5 Mini | 3.0 | 10.0 | 0.0% | 0 | 9.99s | 195 | 160 | 1,856 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Muse Glimmer 30BxhighvsGPT-5 MinimediumGPT-5 MinimediumvsQwen3.8 2.4T A95BlowGemini 3.5 FlashhighvsKimi K3maxGPT-5 MinimediumvsInklinghighTersedia gratisMuse Spark 1.1highvsGPT-5 MinimediumGemini 3.5 FlashhighvsGPT-6 LunamediumClaude Opus 4.8mediumvsGemini 3.5 FlashhighGemini 3.5 FlashhighvsQwen3.7 PlusmediumDeepSeek V4 Flash 0731highvsGPT-5 MinimediumGPT-5 MinimediumvsGLM 5.2highGemini 3.5 FlashhighvsGLM 5.2mediumGemini 3.5 FlashhighvsGPT-5.6 Terramedium