- Peringkat
- #1
- Total token output
- 171,985
- Waktu respons (rata-rata)
- 16.81s
- Total Biaya
- $0.699
Gemini 3.6 Flash (high) vs Qwen3.8 Max (medium)
Gemini 3.6 Flash (high) unggul dalam skor rata-rata dengan 9.9 vs 9.0. Gemini 3.6 Flash (high) memiliki biaya benchmark lebih rendah di $0.699 vs $0.771. Gemini 3.6 Flash (high) lebih cepat di 16.81s vs 23.34s, dengan tingkat keberhasilan 98.5% vs 80.3%.
- Peringkat
- #20
- Total token output
- 92,047
- Waktu respons (rata-rata)
- 23.34s
- Total Biaya
- $0.771
Model yang direkomendasikan
Gemini 3.6 Flash (high)
It has the strongest score in this comparison (9.9) and the best overall balance of cost and response time across all 2 models.
Perbandingan terperinci
| Metrik | Gemini 3.6 Flash Gemini 3.6 Flash high | Qwen3.8 Max Qwen3.8 Max medium |
|---|---|---|
| Skor | 9.9 | 9.0 |
| Peringkat | #1 | #20 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 9.6 | 9.7 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 98.5% | 80.3% |
| Tes tidak stabil | 1 | 1 |
| Total Run | 66 | 66 |
| Biaya per hasil | 6.241 | 4.532 |
| Total Biaya | $0.699 | $0.771 |
| Harga input | $0.750 / 1M | $2.000 / 1M |
| Harga output | $3.750 / 1M | $6.000 / 1M |
| Total token input | 71,470 | 109,055 |
| Token output | 3,276 | 6,566 |
| Token penalaran | 168,709 | 85,481 |
| Waktu respons (rata-rata) | 16.81s | 23.34s |
| Waktu respons (maks) | 104.15s | 126.60s |
| Waktu respons (total) | 369.88s | 513.47s |
| Parameter | ~500B total (~20B aktif) | 2.4T total (~100B aktif) |
| Ketersediaan | Tertutup | Tertutup |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#1 Gemini 3.6 Flash
high- Biaya
- $0.141
- Waktu
- 113.7s
- Token
- 18,776 tok
#20 Qwen3.8 Max
medium- Biaya
- $0.028
- Waktu
- 71.9s
- Token
- 4,750 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.73s | 506 | 162 | 4,623 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 4.17s | 672 | 312 | 2,075 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 10.0 | 10.0 | 100.0% | 0 | 26.32s | 8,128 | 480 | 53,005 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 41.35s | 7,893 | 430 | 23,804 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 10.0 | 10.0 | 100.0% | 0 | 65.10s | 47,441 | 1,702 | 35,615 | |
| Qwen3.8 Max | 8.7 | 6.9 | 83.3% | 1 | 91.25s | 81,584 | 4,526 | 30,688 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 10.0 | 10.0 | 100.0% | 0 | 6.44s | 7,455 | 279 | 7,018 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 8.72s | 7,782 | 270 | 2,519 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 8.2 | 7.2 | 88.9% | 1 | 33.33s | 652 | 12 | 52,941 | |
| Qwen3.8 Max | 3.0 | 10.0 | 0.0% | 0 | 41.77s | 780 | 62 | 20,803 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.01s | 488 | 111 | 1,662 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 6.41s | 516 | 168 | 700 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.07s | 623 | 72 | 4,333 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 3.49s | 699 | 102 | 914 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.36s | 564 | 213 | 3,565 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 4.93s | 696 | 401 | 1,575 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 10.0 | 10.0 | 100.0% | 0 | 8.35s | 5,457 | 234 | 2,771 | |
| Qwen3.8 Max | 10.0 | 10.0 | 100.0% | 0 | 7.83s | 8,229 | 267 | 636 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.6 Flash | 10.0 | 10.0 | 100.0% | 0 | 6.35s | 156 | 11 | 3,176 | |
| Qwen3.8 Max | 3.0 | 10.0 | 0.0% | 0 | 11.49s | 204 | 28 | 1,767 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Qwen3.8 MaxmediumvsGrok 4.5highSeed 2.1 TurbohighvsQwen3.8 MaxmediumSeed 2.1 TurbolowvsQwen3.8 MaxmediumGemini 3.5 FlashlowvsQwen3.8 MaxmediumClaude Opus 5highvsQwen3.8 MaxmediumGemini 3.7 FlashlowvsQwen3.8 MaxmediumGemini 3.5 Flash LitehighvsQwen3.8 MaxmediumClaude Opus 5lowvsQwen3.8 MaxmediumGemini 3.6 FlashlowvsQwen3.8 MaxmediumMuse Spark 1.2highvsQwen3.8 MaxmediumQwen3.8 MaxmediumvsGrok 4.6highGPT-5.5lowvsQwen3.8 Maxmedium