Domain specific: No answer
Domain specific
No answer
See which AI models are most likely to hit No answer on Domain specific, so you can spot weak points faster. Sort by: Tests Correct ↓.
Failure Reasons
35/35
Filter models
No models match the current search and filters.
| Rank | Model | Company | No answer Count | Category Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #90 | GLM 5.2 medium | Z.ai | 1 | 4.1 | $0.151 | 0/3 | 45.5s |
| #102 | MiMo-V2.6-Flash low | Xiaomi | 2 | 3.0 | $0.174 | 0/3 | 276.9s |
| #108 | Grok 4.7 xhigh | X AI | 2 | 3.5 | $2.625 | 0/3 | 190.6s |
| #125 | Qwen3.8 2.4T A95B high | Qwen | 1 | 4.1 | $2.357 | 0/3 | 301.1s |
| #139 | Muse Glimmer 30B high | Meta | 1 | 2.9 | $0.430 | 0/3 | 182.6s |
| #151 | GLM 5.1 medium | Z.ai | 1 | 3.0 | $0.727 | 0/3 | 114.0s |
| #160 | Seed-2.0-Code high | Bytedance Seed | 1 | 3.5 | $1.273 | 0/3 | 419.7s |
| #170 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 2.9 | $0.221 | 0/3 | 146.1s |
| #190 | Laguna XS 2.1 medium | Poolside | 1 | 3.5 | $0.068 | 0/3 | 67.5s |
| #198 | MiMo-V2.5 medium | Xiaomi | 1 | 3.6 | $0.104 | 0/3 | 137.7s |
| #210 | Qwen3.5-35B-A3B medium | Qwen | 1 | 3.5 | $1.148 | 0/3 | 76.4s |
| #221 | Trinity Large Thinking low | Arcee AI | 1 | 2.9 | $0.625 | 0/3 | 140.3s |
| #231 | Mimo V2 Omni medium | Xiaomi | 1 | 3.0 | $0.683 | 0/3 | 47.9s |
| #319 | GLM 4.7 Flash medium | Z.ai | 1 | 3.5 | $0.168 | 0/3 | 96.7s |
| #324 | Laguna Xs.2 medium | Poolside | 1 | 4.1 | $0.015 | 0/3 | 11.1s |