Puzzeloplossing-ranglijst
Zie welke AI-modellen het best presteren op Puzzeloplossing, welke betrouwbaar blijven en waar de grootste verschillen zitten.
216/216
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Puzzeloplossing-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #24 | GPT-5.2 medium | OpenAI | 7.5 | 8.4 | $0.951 | 2/3 | 5.80s |
| #80 | DeepSeek V3.2 medium | DeepSeek | 7.0 | 7.0 | $0.078 | 1/3 | 37.7s |
| #32 | Inkling high | Thinkingmachines | 6.9 | 8.0 | $1.006 | 1/3 | 10.7s |
| #50 | DeepSeek V4 Pro high | DeepSeek | 6.9 | 7.7 | $0.200 | 1/3 | 56.8s |
| #160 | MiMo-V2.5-Pro none | Xiaomi | 6.7 | 5.5 | $0.068 | 1/3 | 1.30s |
| #88 | MiMo-V2.5-Pro medium | Xiaomi | 6.7 | 6.9 | $0.187 | 1/3 | 5.31s |
| #109 | Qwen3.5-27B none | Qwen | 6.7 | 6.5 | $0.090 | 1/3 | 1.38s |
| #132 | Qwen3.5 Plus 2026-04-20 none | Qwen | 6.7 | 6.1 | $0.122 | 1/3 | 1.97s |
| #187 | Grok 4.20 Multi Agent Beta medium | X AI | 6.7 | 4.8 | $5.599 | 1/3 | 5.19s |
| #121 | Gemma 4 31B none | 6.5 | 6.2 | $0.021 | 1/3 | 4.23s | |
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 6.4 | 7.4 | $0.387 | 1/3 | 3.11s |
| #115 | Mimo V2 PRO medium | Xiaomi | 6.4 | 6.3 | $0.333 | 1/3 | 5.08s |
| #182 | GLM 4.7 Flash none | Z.ai | 6.4 | 4.9 | $0.016 | 1/3 | 1.20s |
| #129 | Inkling low | Thinkingmachines | 6.4 | 6.1 | $0.187 | 1/3 | 2.97s |
| #208 | Grok Build 0.1 none | X AI | 6.4 | 4.0 | $0.547 | 1/3 | 9.55s |