Peringkat Kecerdasan umum
Lihat model AI mana yang paling baik di Kecerdasan umum, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Metrik ↑.
210/210
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Kecerdasan umum | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #95 | Gemma 4 26B A4B medium | 10.0 | 6.6 | $0.089 | 1/1 | 29.8s | |
| #100 | Hy3 preview medium | Tencent | 10.0 | 6.5 | $0.018 | 1/1 | 16.8s |
| #109 | Mimo V2 PRO medium | Xiaomi | 10.0 | 6.3 | $0.333 | 1/1 | 4.92s |
| #110 | Gemma 4 31B medium | 10.0 | 6.3 | $0.163 | 1/1 | 9.57s | |
| #115 | Gemma 4 31B none | 10.0 | 6.2 | $0.035 | 1/1 | 2.09s | |
| #116 | Seed-2.0-Lite none | Bytedance Seed | 10.0 | 6.2 | $0.066 | 1/1 | 3.45s |
| #123 | Inkling low | Thinkingmachines | 10.0 | 6.1 | $0.187 | 1/1 | 3.44s |
| #124 | Qwen3.6 Flash none | Qwen | 10.0 | 6.1 | $0.062 | 1/1 | 947ms |
| #125 | Qwen3.5-Flash none | Qwen | 10.0 | 6.1 | $0.073 | 1/1 | 803ms |
| #131 | Grok 4.20 Beta medium | X AI | 10.0 | 6.0 | $0.750 | 1/1 | 5.78s |
| #133 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 1/1 | 9.34s | |
| #141 | GLM 5 none | Z.ai | 10.0 | 5.7 | $0.041 | 1/1 | 3.27s |
| #155 | Kimi K2.5 none | Moonshot AI | 10.0 | 5.5 | $0.127 | 1/1 | 4.00s |
| #163 | Gemini 3.1 Flash Lite Preview high | 10.0 | 5.3 | $2.310 | 1/1 | 5.25s | |
| #166 | Qwen3 Coder Next none | Qwen | 10.0 | 5.1 | $0.025 | 1/1 | 1.34s |