Trivia: API error
Trivia
API error
See which AI models are most likely to hit API error on Trivia, so you can spot weak points faster. Sort by: Total Cost ↑.
Failure Reasons
13/13
Filter models
No models match the current search and filters.
| Rank | Model | Company | API error Count | Category Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #137 | North Mini Code medium | Cohere | 1 | 3.0 | $0.000 | 0/1 | 305.0s |
| #175 | Qwen3.6 Plus Preview medium | Qwen | 1 | 3.0 | $0.000 | 0/1 | 0ms |
| #193 | Elephant Alpha none | Openrouter | 1 | 3.0 | $0.000 | 0/1 | 0ms |
| #195 | Elephant Alpha medium | Openrouter | 1 | 3.0 | $0.000 | 0/1 | 0ms |
| #207 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 1 | 3.0 | $0.000 | 0/1 | 0ms |
| #208 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 1 | 3.0 | $0.000 | 0/1 | 0ms |
| #205 | Laguna Xs.2 none | Poolside | 1 | 3.0 | $0.004 | 0/1 | 0ms |
| #192 | Laguna M.1 none | Poolside | 1 | 3.0 | $0.009 | 0/1 | 0ms |
| #198 | Laguna Xs.2 medium | Poolside | 1 | 3.0 | $0.015 | 0/1 | 0ms |
| #162 | Ling-2.6-1T none | Inclusionai | 1 | 3.0 | $0.016 | 0/1 | 0ms |
| #186 | Laguna M.1 medium | Poolside | 1 | 3.0 | $0.033 | 0/1 | 0ms |
| #204 | Qwen3.5-9B medium | Qwen | 1 | 3.0 | $0.036 | 0/1 | 177.0s |
| #133 | Gemini 3 PRO Preview medium | 1 | 3.0 | $0.385 | 0/1 | 0ms |