Peringkat Pengetahuan umum
Lihat model AI mana yang paling baik di Pengetahuan umum, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Total Biaya ↓.
Model yang ditampilkan
15
Rata-rata Skor Pengetahuan umum
3.2
Model terbaik
Grok 4.20 Multi Agent Beta 0.0
246/246
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pengetahuan umum | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #81 | Claude Sonnet 4.6 none | Anthropic | 3.0 | 7.3 | $0.661 | 0/1 | 4.67s |
| #155 | Trinity Large Thinking low | Arcee AI | 3.0 | 6.0 | $0.656 | 0/1 | 2.10s |
| #30 | Muse Spark 1.2 low | Meta | 3.0 | 8.4 | $0.650 | 0/1 | 10.00s |
| #37 | Muse Spark 1.1 low | Meta | 3.0 | 8.3 | $0.647 | 0/1 | 8.17s |
| #127 | Gemini 3.1 Flash Lite Preview low | 3.0 | 6.5 | $0.646 | 0/1 | 1.35s | |
| #38 | Gemini 2.5 Flash medium | 3.0 | 8.2 | $0.643 | 0/1 | 2.76s | |
| #13 | Gemini 3.5 Flash medium | 10.0 | 9.1 | $0.642 | 1/1 | 2.75s | |
| #215 | Trinity Large Thinking high | Arcee AI | 3.0 | 4.8 | $0.632 | 0/1 | 125.1s |
| #128 | Gemini 3.1 Flash Lite low | 3.0 | 6.5 | $0.621 | 0/1 | 1.46s | |
| #44 | GPT-5.2 Chat none | OpenAI | 3.0 | 8.0 | $0.604 | 0/1 | 6.89s |
| #97 | Kimi K2.5 medium | Moonshot AI | 3.0 | 7.0 | $0.600 | 0/1 | 83.9s |
| #72 | GPT-5.3 Chat none | OpenAI | 3.0 | 7.5 | $0.571 | 0/1 | 4.38s |
| #136 | Claude Sonnet 5 none | Anthropic | 3.0 | 6.3 | $0.548 | 0/1 | 4.31s |
| #238 | Grok Build 0.1 none | X AI | 3.0 | 4.0 | $0.547 | 0/1 | 36.1s |
| #108 | GPT-5.5 none | OpenAI | 3.0 | 6.9 | $0.544 | 0/1 | 5.01s |