Clasament Combinat
Vezi ce modele AI se descurcă cel mai bine la Combinat, care rămân fiabile și unde apar cele mai mari diferențe. Sortează după: Teste corecte ↓.
216/216
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Scor Combinat | Scor | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #60 | GPT-5.4 Mini medium | OpenAI | 6.9 | 7.5 | $0.756 | 1/2 | 59.6s |
| #61 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 6.9 | 7.5 | $0.437 | 1/2 | 175.8s |
| #62 | Qwen3.5-27B medium | Qwen | 7.3 | 7.4 | $1.627 | 1/2 | 595.2s |
| #63 | Qwen3.7 Max none | Qwen | 6.5 | 7.4 | $0.197 | 1/2 | 37.2s |
| #64 | LongCat 2.0 medium | Meituan | 7.3 | 7.4 | $0.478 | 1/2 | 151.0s |
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 6.4 | 7.4 | $0.387 | 1/2 | 111.9s |
| #68 | Gemini 3.1 Flash Lite Preview medium | 7.2 | 7.3 | $0.115 | 1/2 | 16.6s | |
| #69 | Gemini 3.1 Flash Lite medium | 7.2 | 7.3 | $0.117 | 1/2 | 18.5s | |
| #71 | Step 3.7 Flash low | Stepfun | 7.3 | 7.3 | $0.454 | 1/2 | 66.2s |
| #72 | Kimi K2.6 medium | Moonshot AI | 6.9 | 7.2 | $1.036 | 1/2 | 458.6s |
| #73 | KAT-Coder-Pro V2.5 high | Kwaipilot | 7.3 | 7.2 | $0.482 | 1/2 | 106.7s |
| #74 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 6.5 | 7.2 | $0.317 | 1/2 | 92.4s |
| #76 | Qwen3.5-122B-A10B medium | Qwen | 6.4 | 7.1 | $1.046 | 1/2 | 313.5s |
| #77 | Grok 4.3 medium | X AI | 6.5 | 7.1 | $0.779 | 1/2 | 55.1s |
| #79 | Grok 4.20 medium | X AI | 8.7 | 7.1 | $0.777 | 1/2 | 42.2s |