Peringkat Pengetahuan umum
Lihat model AI mana yang paling baik di Pengetahuan umum, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Total Biaya ↓.
Model yang ditampilkan
15
Rata-rata Skor Pengetahuan umum
3.2
Model terbaik
Grok 4.20 Multi Agent Beta 0.0
246/246
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pengetahuan umum | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #110 | Gemini 3 Flash Preview none | 3.0 | 6.8 | $0.085 | 0/1 | 1.07s | |
| #206 | Laguna S 2.1 low | Poolside | 3.0 | 5.0 | $0.082 | 0/1 | 202.5s |
| #123 | MiMo-V2.5 medium | Xiaomi | 3.0 | 6.5 | $0.082 | 0/1 | 51.3s |
| #46 | DeepSeek V4 Flash 0731 high | DeepSeek | 3.0 | 8.0 | $0.079 | 0/1 | 110.6s |
| #96 | DeepSeek V3.2 medium | DeepSeek | 3.0 | 7.0 | $0.078 | 0/1 | 84.0s |
| #173 | KAT-Coder-Air V2.5 high | Kwaipilot | 3.0 | 5.6 | $0.077 | 0/1 | 21.7s |
| #150 | Qwen3.5-Flash none | Qwen | 3.0 | 6.1 | $0.073 | 0/1 | 588ms |
| #130 | Qwen3.5 Plus 2026-02-15 none | Qwen | 3.0 | 6.4 | $0.073 | 0/1 | 1.11s |
| #220 | Grok 4.1 Fast medium | X AI | 3.0 | 4.7 | $0.069 | 0/1 | 25.5s |
| #183 | MiMo-V2.5-Pro none | Xiaomi | 3.0 | 5.5 | $0.068 | 0/1 | 1.89s |
| #83 | DeepSeek V4 Flash 0731 medium | DeepSeek | 3.0 | 7.3 | $0.068 | 0/1 | 56.6s |
| #124 | Laguna XS 2.1 medium | Poolside | 3.0 | 6.5 | $0.068 | 0/1 | 10.9s |
| #217 | KAT-Coder-Air V2.5 none | Kwaipilot | 3.0 | 4.8 | $0.067 | 0/1 | 18.0s |
| #181 | Qwen3.6 27B none | Qwen | 3.0 | 5.5 | $0.067 | 0/1 | 4.03s |
| #140 | Seed-2.0-Lite none | Bytedance Seed | 3.0 | 6.2 | $0.066 | 0/1 | 1.96s |