Peringkat Pemecahan teka-teki
Lihat model AI mana yang paling baik di Pemecahan teka-teki, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Total Biaya ↑.
Model yang ditampilkan
15
Rata-rata Skor Pemecahan teka-teki
7.0
Model terbaik
Dots 3 Note Preview 5.3
359/359
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemecahan teka-teki | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #156 | Mercury 2.5 high | Inception | 8.7 | 7.1 | $0.031 | 2/3 | 1.39s |
| #320 | Laguna M.1 medium | Poolside | 5.3 | 4.7 | $0.033 | 1/3 | 10.2s |
| #349 | gpt-oss-120b none | OpenAI | 6.0 | 3.7 | $0.033 | 1/3 | 8.21s |
| #324 | Qwen3 Coder Next medium | Qwen | 3.0 | 4.6 | $0.034 | 0/3 | 1.25s |
| #332 | Granite 4.2 8B none | IBM Granite | 3.0 | 4.3 | $0.037 | 0/3 | 107.6s |
| #271 | MiMo-V2.6-Flash none | Xiaomi | 3.7 | 5.4 | $0.037 | 0/3 | 739ms |
| #272 | DeepSeek V4 Flash 0423 none | DeepSeek | 3.1 | 5.4 | $0.040 | 0/3 | 23.7s |
| #309 | Hy4 preview none | Tencent | 4.6 | 4.8 | $0.041 | 0/3 | 24.1s |
| #312 | GPT-5.4 Nano none | OpenAI | 5.4 | 4.8 | $0.041 | 1/3 | 1.25s |
| #109 | DeepSeek V4 Flash 0423 high | DeepSeek | 8.2 | 7.6 | $0.042 | 2/3 | 26.1s |
| #268 | Hy3 preview low | Tencent | 5.3 | 5.5 | $0.042 | 1/3 | 7.51s |
| #150 | Qwen3.7 Flash low | Qwen | 7.3 | 7.2 | $0.043 | 1/3 | 9.79s |
| #212 | MiMo-V2-Flash medium | Xiaomi | 7.7 | 6.3 | $0.043 | 2/3 | 3.87s |
| #207 | LongCat 2.0 none | Meituan | 4.0 | 6.4 | $0.044 | 0/3 | 2.74s |
| #262 | Mimo V2 PRO none | Xiaomi | 6.0 | 5.6 | $0.045 | 1/3 | 1.61s |