Peringkat Pengetahuan umum
Lihat model AI mana yang paling baik di Pengetahuan umum, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Tes benar ↓.
330/330
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pengetahuan umum | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #104 | GPT-5.6 Terra low | OpenAI | 3.0 | 7.5 | $0.420 | 0/1 | 5.95s |
| #105 | MiniMax M3 medium | Minimax | 3.0 | 7.5 | $0.300 | 0/1 | 100.8s |
| #106 | GPT 5.3 Chat none | OpenAI | 3.0 | 7.5 | $0.533 | 0/1 | 4.38s |
| #107 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 3.0 | 7.5 | $0.459 | 0/1 | 103.8s |
| #108 | Qwen3.5-27B medium | Qwen | 3.0 | 7.5 | $0.982 | 0/1 | 85.1s |
| #109 | Mercury 2.5 Preview medium | Inception | 3.0 | 7.5 | $0.024 | 0/1 | 4.13s |
| #110 | GPT-5.4 Mini medium | OpenAI | 3.0 | 7.5 | $0.786 | 0/1 | 30.1s |
| #111 | Grok Build 0.1 medium | X AI | 3.0 | 7.5 | $1.130 | 0/1 | 53.5s |
| #113 | Gemini 3.1 Flash Lite Preview medium | 3.0 | 7.4 | $0.117 | 0/1 | 2.68s | |
| #114 | Qwen3.7 Max none | Qwen | 3.0 | 7.4 | $0.197 | 0/1 | 856ms |
| #115 | Kimi K2.7 Code medium | Moonshot AI | 3.0 | 7.4 | $0.655 | 0/1 | 341.8s |
| #116 | GPT-5.6 Luna medium | OpenAI | 3.0 | 7.4 | $0.072 | 0/1 | 6.64s |
| #117 | LongCat 2.0 medium | Meituan | 3.0 | 7.4 | $0.499 | 0/1 | 191.2s |
| #118 | Qwen3.8 2.4T A95B high | Qwen | 3.0 | 7.4 | $2.357 | 0/1 | 348.0s |
| #119 | Grok 4.6 low | X AI | 3.0 | 7.4 | $0.449 | 0/1 | 26.1s |