Peringkat Pemecahan teka-teki
Lihat model AI mana yang paling baik di Pemecahan teka-teki, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Waktu respons (rata-rata) ↑.
359/359
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemecahan teka-teki | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #165 | Seed-2.0-Mini medium | Bytedance Seed | 8.2 | 7.0 | $0.116 | 2/3 | 31.8s |
| #346 | Qwen3.5-9B medium | Qwen | 3.0 | 3.8 | $0.062 | 0/3 | 32.3s |
| #344 | Ling 3.0 Tiny low | Inclusionai | 3.0 | 3.8 | $0.000 | 0/3 | 32.5s |
| #122 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 3/3 | 32.5s |
| #220 | Qwen3.5-35B-A3B medium | Qwen | 8.2 | 6.1 | $1.148 | 2/3 | 33.1s |
| #86 | GLM 5.2 high | Z.ai | 6.0 | 8.0 | $0.799 | 1/3 | 33.7s |
| #174 | Seed-2.0-Code medium | Bytedance Seed | 8.2 | 6.8 | $1.153 | 2/3 | 34.3s |
| #347 | Ling 3.0 Tiny medium | Inclusionai | 3.6 | 3.8 | $0.000 | 0/3 | 34.7s |
| #160 | DeepSeek V3.2 medium | DeepSeek | 7.0 | 7.0 | $0.078 | 1/3 | 37.7s |
| #38 | Muse Spark 1.3 high | Meta | 8.7 | 8.9 | $1.653 | 2/3 | 38.4s |
| #130 | Kimi K2.7 Code medium | Moonshot AI | 5.9 | 7.4 | $0.671 | 1/3 | 41.0s |
| #176 | Solar Pro 4 low | Upstage | 9.0 | 6.8 | $0.130 | 2/3 | 42.1s |
| #52 | Muse Spark 1.1 medium | Meta | 7.9 | 8.6 | $1.420 | 2/3 | 42.5s |
| #166 | Kimi K2.5 medium | Moonshot AI | 5.3 | 7.0 | $0.479 | 1/3 | 43.2s |
| #78 | Qwen3.8 2.4T A95B low | Qwen | 10.0 | 8.1 | $2.672 | 3/3 | 43.4s |