Peringkat Kecerdasan umum
Lihat model AI mana yang paling baik di Kecerdasan umum, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Tes benar ↑.
330/330
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Kecerdasan umum | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #109 | Mercury 2.5 Preview medium | Inception | 5.0 | 7.5 | $0.024 | 0/1 | 2.09s |
| #110 | GPT-5.4 Mini medium | OpenAI | 4.5 | 7.5 | $0.786 | 0/1 | 3.72s |
| #111 | Grok Build 0.1 medium | X AI | 4.4 | 7.5 | $1.130 | 0/1 | 18.4s |
| #116 | GPT-5.6 Luna medium | OpenAI | 5.1 | 7.4 | $0.072 | 0/1 | 4.34s |
| #117 | LongCat 2.0 medium | Meituan | 4.8 | 7.4 | $0.499 | 0/1 | 16.4s |
| #118 | Qwen3.8 2.4T A95B high | Qwen | 6.1 | 7.4 | $2.357 | 0/1 | 11.4s |
| #121 | Claude Sonnet 4.6 none | Anthropic | 6.1 | 7.3 | $0.661 | 0/1 | 2.56s |
| #122 | GLM 5.3 high | Z.ai | 6.1 | 7.3 | $0.403 | 0/1 | 8.00s |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 4.1 | 7.3 | $0.400 | 0/1 | 2.32s |
| #124 | GLM 5.3 Flash high | Z.ai | 5.0 | 7.3 | $0.034 | 0/1 | 3.33s |
| #126 | Qwen3.7 Plus none | Qwen | 5.3 | 7.3 | $0.106 | 0/1 | 1.33s |
| #127 | DeepSeek V4 Flash 0731 medium | DeepSeek | 6.1 | 7.3 | $0.046 | 0/1 | 12.2s |
| #130 | KAT-Coder-Pro V2.5 high | Kwaipilot | 5.1 | 7.2 | $0.506 | 0/1 | 3.27s |
| #131 | Muse Glimmer 30B high | Meta | 5.3 | 7.2 | $0.397 | 0/1 | 6.36s |
| #132 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 4.9 | 7.2 | $0.323 | 0/1 | 25.3s |