Peringkat Pemecahan teka-teki
Lihat model AI mana yang paling baik di Pemecahan teka-teki, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Waktu respons (rata-rata) ↓.
359/359
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemecahan teka-teki | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #310 | Ring-2.6-1T none | Inclusionai | 7.7 | 4.8 | $0.026 | 2/3 | 31.5s |
| #21 | Claude Opus 5.5 high | Anthropic | 8.7 | 9.3 | $1.266 | 2/3 | 30.8s |
| #71 | DeepSeek V4.1 Flash max | DeepSeek | 5.5 | 8.3 | $0.445 | 1/3 | 30.8s |
| #30 | Claude Opus 5.5 medium | Anthropic | 10.0 | 9.0 | $1.080 | 3/3 | 30.1s |
| #20 | Claude Opus 5.5 low | Anthropic | 8.7 | 9.3 | $0.952 | 2/3 | 29.8s |
| #242 | Hy3 preview high | Tencent | 7.7 | 5.9 | $0.135 | 2/3 | 27.9s |
| #224 | Qwen3.5-Flash medium | Qwen | 8.2 | 6.1 | $0.142 | 2/3 | 27.6s |
| #159 | GPT-6 Luna low | OpenAI | 7.7 | 7.0 | $0.020 | 2/3 | 27.5s |
| #40 | Seed 2.1 Turbo high | Bytedance Seed | 10.0 | 8.9 | $1.797 | 3/3 | 27.3s |
| #216 | Gemma 4 31B medium | 9.9 | 6.2 | $0.100 | 3/3 | 26.9s | |
| #109 | DeepSeek V4 Flash 0423 high | DeepSeek | 8.2 | 7.6 | $0.042 | 2/3 | 26.1s |
| #260 | GPT-6 Luna none | OpenAI | 5.4 | 5.6 | $0.012 | 1/3 | 26.0s |
| #145 | Kimi K2.6 medium | Moonshot AI | 6.0 | 7.2 | $1.247 | 1/3 | 25.1s |
| #43 | Muse Spark 1.3 medium | Meta | 10.0 | 8.8 | $1.469 | 3/3 | 25.0s |
| #300 | MiniMax M2.7 medium | Minimax | 5.9 | 5.0 | $0.208 | 1/3 | 24.9s |