Data parsing and extraction: API error
Data parsing and extraction
API error
See which AI models are most likely to hit API error on Data parsing and extraction, so you can spot weak points faster. Sort by: Tests Correct ↓.
Failure Reasons
22/22
Filter models
No models match the current search and filters.
| Rank | Model | Company | API error Count | Category Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #52 | DeepSeek V4.1 Flash low | DeepSeek | 1 | 6.5 | $0.224 | 1/2 | 3.80s |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 1 | 6.5 | $0.287 | 1/2 | 4.19s |
| #54 | DeepSeek V4.1 Flash medium | DeepSeek | 1 | 6.5 | $0.272 | 1/2 | 3.77s |
| #65 | DeepSeek V4.1 Flash max | DeepSeek | 1 | 6.5 | $0.537 | 1/2 | 4.56s |
| #161 | Gemini 3.5 Flash none | 1 | 6.5 | $1.093 | 1/2 | 8.10s | |
| #164 | Seed-2.0-Code medium | Bytedance Seed | 1 | 7.3 | $1.153 | 1/2 | 18.8s |
| #191 | Hy3 preview medium | Tencent | 1 | 6.5 | $0.049 | 1/2 | 5.25s |
| #202 | MiMo-V2-Flash medium | Xiaomi | 1 | 6.5 | $0.043 | 1/2 | 0ms |
| #210 | Qwen3.5-35B-A3B medium | Qwen | 1 | 7.3 | $1.148 | 1/2 | 59.3s |
| #214 | Qwen3.5-Flash medium | Qwen | 1 | 7.3 | $0.142 | 1/2 | 57.0s |
| #232 | Hy3 preview high | Tencent | 1 | 6.5 | $0.135 | 1/2 | 12.1s |
| #255 | Hy4 preview low | Tencent | 1 | 8.7 | $1.745 | 1/2 | 88.5s |
| #257 | Hy3 preview low | Tencent | 1 | 6.5 | $0.042 | 1/2 | 5.85s |
| #262 | DeepSeek V4.1 Flash none | DeepSeek | 1 | 6.5 | $0.185 | 1/2 | 3.09s |
| #281 | Mistral Small 4 medium | Mistral | 1 | 7.3 | $0.097 | 1/2 | 1.23s |