Parsare și extragere de date: Răspuns greșit
Parsare și extragere de date
Răspuns greșit
Vezi ce modele AI au cele mai mari șanse să întâmpine Răspuns greșit la Parsare și extragere de date, ca să găsești mai repede punctele slabe. Sortează după: Cost total ↓.
36/36
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Număr de Răspuns greșit | Scor de categorie | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #45 | Claude Opus 4.8 low | Anthropic | 1 | 6.3 | $2.077 | 1/2 | 2.27s |
| #17 | Claude Opus 4.8 medium | Anthropic | 1 | 7.1 | $1.931 | 1/2 | 12.3s |
| #70 | Claude Opus 4.8 none | Anthropic | 1 | 7.3 | $1.166 | 1/2 | 1.77s |
| #208 | Grok Build 0.1 none | X AI | 1 | 3.8 | $0.547 | 0/2 | 9.33s |
| #102 | LongCat 2.0 high | Meituan | 1 | 3.6 | $0.469 | 0/2 | 11.0s |
| #85 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 1 | 7.3 | $0.467 | 1/2 | 4.70s |
| #71 | Step 3.7 Flash low | Stepfun | 1 | 7.3 | $0.454 | 1/2 | 2.29s |
| #196 | MiniMax M2.5 medium | Minimax | 2 | 4.6 | $0.340 | 0/2 | 7.48s |
| #115 | Mimo V2 PRO medium | Xiaomi | 1 | 7.3 | $0.333 | 1/2 | 17.2s |
| #88 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 7.3 | $0.187 | 1/2 | 18.8s |
| #178 | MiniMax M2.7 medium | Minimax | 1 | 6.3 | $0.163 | 1/2 | 21.9s |
| #161 | Kimi K2.5 none | Moonshot AI | 1 | 7.3 | $0.127 | 1/2 | 42.1s |
| #134 | GPT-5 Nano medium | OpenAI | 2 | 3.7 | $0.114 | 0/2 | 21.4s |
| #114 | Ring-2.6-1T medium | Inclusionai | 1 | 6.5 | $0.103 | 1/2 | 37.4s |
| #82 | Mercury 2 medium | Inception | 1 | 7.3 | $0.093 | 1/2 | 1.11s |