Clasament Apelare instrumente
Vezi ce modele AI se descurcă cel mai bine la Apelare instrumente, care rămân fiabile și unde apar cele mai mari diferențe.
Modele afișate
15
Media pentru Scor Apelare instrumente
8.7
Cel mai bun model
Gemini 3 Flash Preview 10.0
210/210
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Scor Apelare instrumente | Scor | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #58 | Qwen3.5-27B medium | Qwen | 10.0 | 7.4 | $1.627 | 1/1 | 7.45s |
| #59 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |
| #60 | LongCat 2.0 medium | Meituan | 10.0 | 7.4 | $0.478 | 1/1 | 10.7s |
| #61 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.177 | 1/1 | 4.99s | |
| #62 | KAT-Coder-Pro V2.5 low | Kwaipilot | 10.0 | 7.4 | $0.387 | 1/1 | 18.4s |
| #63 | Claude Sonnet 4.6 none | Anthropic | 10.0 | 7.3 | $0.661 | 1/1 | 4.11s |
| #64 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.3 | $0.115 | 1/1 | 3.80s | |
| #65 | Gemini 3.1 Flash Lite medium | 10.0 | 7.3 | $0.117 | 1/1 | 4.55s | |
| #66 | Claude Opus 4.8 none | Anthropic | 10.0 | 7.3 | $1.166 | 1/1 | 5.35s |
| #67 | Step 3.7 Flash low | Stepfun | 10.0 | 7.3 | $0.454 | 1/1 | 3.25s |
| #68 | Kimi K2.6 medium | Moonshot AI | 10.0 | 7.2 | $1.036 | 1/1 | 8.92s |
| #69 | KAT-Coder-Pro V2.5 high | Kwaipilot | 10.0 | 7.2 | $0.482 | 1/1 | 28.0s |
| #70 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 10.0 | 7.2 | $0.317 | 1/1 | 14.7s |
| #71 | Qwen3.7 Plus none | Qwen | 10.0 | 7.2 | $0.106 | 1/1 | 3.54s |
| #72 | Qwen3.5-122B-A10B medium | Qwen | 10.0 | 7.1 | $1.046 | 1/1 | 4.60s |