Peringkat Pemecahan teka-teki
Lihat model AI mana yang paling baik di Pemecahan teka-teki, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Waktu respons (rata-rata) ↑.
359/359
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemecahan teka-teki | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #194 | Inkling Small medium | Thinkingmachines | 5.8 | 6.6 | $0.113 | 1/3 | 5.24s |
| #128 | Gemini 3.1 Flash Lite Preview medium | 7.7 | 7.4 | $0.117 | 2/3 | 5.30s | |
| #100 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 3/3 | 5.31s |
| #180 | MiMo-V2.5-Pro medium | Xiaomi | 6.7 | 6.8 | $0.221 | 1/3 | 5.31s |
| #318 | Hunter Alpha medium | OpenRouter | 6.1 | 4.7 | $0.000 | 1/3 | 5.35s |
| #284 | Ling-2.6-1T none | Inclusionai | 3.1 | 5.3 | $0.016 | 0/3 | 5.36s |
| #88 | GPT-5.6 Terra high | OpenAI | 7.7 | 8.0 | $0.836 | 2/3 | 5.45s |
| #48 | GLM 5.3 Flash max | Z.ai | 8.7 | 8.7 | $0.117 | 2/3 | 5.61s |
| #74 | Claude Fable 5.1 medium | Anthropic | 7.6 | 8.3 | $2.909 | 2/3 | 5.70s |
| #136 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.185 | 3/3 | 5.77s | |
| #183 | Gemma 4 26B A4B medium | 10.0 | 6.8 | $0.084 | 3/3 | 5.79s | |
| #64 | GPT-5.2 medium | OpenAI | 7.5 | 8.4 | $1.182 | 2/3 | 5.80s |
| #42 | Qwen3.8 Max (0902) medium | Qwen | 10.0 | 8.8 | $0.677 | 3/3 | 5.89s |
| #196 | Qwen3.6 35B A3B medium | Qwen | 8.0 | 6.6 | $0.750 | 2/3 | 5.95s |
| #265 | Nemotron 3.5 Lightning high | NVIDIA | 3.6 | 5.6 | $0.133 | 0/3 | 6.09s |