Data parsing and extraction: API error
Data parsing and extraction
API error
See which AI models are most likely to hit API error on Data parsing and extraction, so you can spot weak points faster. Sort by: Total Cost ↑.
Failure Reasons
14/14
Filter models
No models match the current search and filters.
| Rank | Model | Company | API error Count | Category Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #199 | Hy3 preview none | Tencent | 1 | 6.5 | $0.003 | 1/2 | 2.85s |
| #206 | gpt-oss-120b none | OpenAI | 1 | 6.5 | $0.010 | 1/2 | 7.12s |
| #153 | Hy3 preview low | Tencent | 1 | 6.5 | $0.015 | 1/2 | 5.85s |
| #100 | Hy3 preview medium | Tencent | 1 | 6.5 | $0.018 | 1/2 | 5.25s |
| #209 | Step 3.5 Flash none | Stepfun | 1 | 1.5 | $0.020 | 0/1 | 0ms |
| #200 | MiMo-V2-Flash none | Xiaomi | 1 | 2.9 | $0.025 | 0/2 | 19.7s |
| #179 | Ring-2.6-1T none | Inclusionai | 1 | 3.0 | $0.026 | 0/2 | 45.9s |
| #113 | MiMo-V2-Flash medium | Xiaomi | 1 | 6.5 | $0.043 | 1/2 | 0ms |
| #135 | Hy3 preview high | Tencent | 1 | 6.5 | $0.048 | 1/2 | 12.1s |
| #167 | Mistral Small 4 medium | Mistral | 1 | 7.3 | $0.096 | 1/2 | 1.23s |
| #114 | Qwen3.5-Flash medium | Qwen | 1 | 7.3 | $0.139 | 1/2 | 57.0s |
| #202 | Grok Build 0.1 none | X AI | 1 | 3.8 | $0.547 | 0/2 | 9.33s |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 1 | 7.3 | $0.837 | 1/2 | 59.3s |
| #79 | Gemini 3.5 Flash none | 1 | 6.5 | $1.079 | 1/2 | 8.10s |