Clasament Apelare instrumente
Vezi ce modele AI se descurcă cel mai bine la Apelare instrumente, care rămân fiabile și unde apar cele mai mari diferențe. Sortează după: Teste corecte ↑.
216/216
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Scor Apelare instrumente | Scor | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #57 | GPT-5.4 Nano medium | OpenAI | 10.0 | 7.5 | $0.138 | 1/1 | 7.71s |
| #58 | GPT-5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.571 | 1/1 | 8.36s |
| #61 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.437 | 1/1 | 7.54s |
| #62 | Qwen3.5-27B medium | Qwen | 10.0 | 7.4 | $1.627 | 1/1 | 7.45s |
| #63 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |
| #64 | LongCat 2.0 medium | Meituan | 10.0 | 7.4 | $0.478 | 1/1 | 10.7s |
| #65 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.177 | 1/1 | 4.99s | |
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 10.0 | 7.4 | $0.387 | 1/1 | 18.4s |
| #67 | Claude Sonnet 4.6 none | Anthropic | 10.0 | 7.3 | $0.661 | 1/1 | 4.11s |
| #68 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.3 | $0.115 | 1/1 | 3.80s | |
| #69 | Gemini 3.1 Flash Lite medium | 10.0 | 7.3 | $0.117 | 1/1 | 4.55s | |
| #70 | Claude Opus 4.8 none | Anthropic | 10.0 | 7.3 | $1.166 | 1/1 | 5.35s |
| #71 | Step 3.7 Flash low | Stepfun | 10.0 | 7.3 | $0.454 | 1/1 | 3.25s |
| #72 | Kimi K2.6 medium | Moonshot AI | 10.0 | 7.2 | $1.036 | 1/1 | 8.92s |
| #73 | KAT-Coder-Pro V2.5 high | Kwaipilot | 10.0 | 7.2 | $0.482 | 1/1 | 28.0s |