Combined: No answer
Combined
No answer
See which AI models are most likely to hit No answer on Combined, so you can spot weak points faster.
Failure Reasons
46/46
Filter models
No models match the current search and filters.
| Rank | Model | Company | No answer Count | Category Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #69 | GPT-5 Mini medium | OpenAI | 1 | 7.3 | $0.241 | 1/2 | 99.8s |
| #70 | Muse Glimmer 30B xhigh | Meta | 1 | 6.0 | $0.471 | 0/2 | 272.7s |
| #76 | Inkling medium | Thinkingmachines | 1 | 7.3 | $0.383 | 1/2 | 41.2s |
| #79 | GPT-5.2 Chat none | OpenAI | 1 | 7.3 | $0.594 | 1/2 | 13.9s |
| #89 | Seed-2.0-Lite medium | Bytedance Seed | 1 | 6.4 | $0.236 | 1/2 | 58.5s |
| #108 | Mercury 2.5 Preview medium | Inception | 1 | 6.5 | $0.024 | 1/2 | 13.9s |
| #111 | Gemini 3.8 Flash low | 1 | 3.8 | $0.239 | 0/2 | 19.6s | |
| #130 | Muse Glimmer 30B high | Meta | 1 | 6.4 | $0.397 | 1/2 | 115.4s |
| #133 | Muse Glimmer 30B medium | Meta | 1 | 6.5 | $0.211 | 1/2 | 76.5s |
| #135 | Muse Glimmer 30B low | Meta | 1 | 3.8 | $0.143 | 0/2 | 132.0s |
| #138 | Mercury 2.5 high | Inception | 1 | 6.4 | $0.031 | 1/2 | 16.0s |
| #139 | Grok 4.3 medium | X AI | 1 | 6.5 | $0.741 | 1/2 | 55.1s |
| #146 | Seed-2.0-Mini medium | Bytedance Seed | 1 | 7.3 | $0.116 | 1/2 | 282.3s |
| #162 | Gemini 3 Flash Preview none | 1 | 3.8 | $0.085 | 0/2 | 12.4s | |
| #171 | Gemini 3.5 Flash Lite low | 1 | 3.8 | $0.138 | 0/2 | 11.0s |