领域专项:额外格式
领域专项
额外格式
看看哪些 AI 模型在 领域专项 上最容易遇到 额外格式,更快找出薄弱点。 排序方式: 测试正确 ↓.
13/13
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 额外格式 次数 | 分类得分 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #48 | Grok Build 0.1 medium | X AI | 1 | 5.3 | $1.097 | 1/3 | 158.0s |
| #75 | Grok 4.20 medium | X AI | 1 | 5.3 | $0.777 | 1/3 | 27.0s |
| #84 | MiMo-V2.5-Pro medium | Xiaomi | 2 | 5.3 | $0.187 | 1/3 | 37.9s |
| #101 | MiMo-V2.5 medium | Xiaomi | 1 | 5.3 | $0.082 | 1/3 | 34.5s |
| #40 | Claude Sonnet 4.6 medium | Anthropic | 1 | 2.9 | $2.057 | 0/3 | 0ms |
| #43 | Claude Opus 4.6 medium | Anthropic | 2 | 3.0 | $3.059 | 0/3 | 83.4s |
| #46 | DeepSeek V4 Pro high | DeepSeek | 1 | 3.6 | $0.200 | 0/3 | 151.5s |
| #134 | Mimo V2 Omni medium | Xiaomi | 1 | 3.0 | $0.683 | 0/3 | 47.9s |
| #144 | KAT-Coder-Air V2.5 high | Kwaipilot | 2 | 2.9 | $0.077 | 0/3 | 7.47s |
| #158 | KAT-Coder-Air V2.5 low | Kwaipilot | 2 | 2.9 | $0.041 | 0/3 | 4.99s |
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 1 | 2.9 | $5.599 | 0/3 | 24.7s |
| #184 | Hunter Alpha medium | OpenRouter | 1 | 3.0 | $0.000 | 0/3 | 10.5s |
| #197 | Grok 4.20 none | X AI | 1 | 3.0 | $0.057 | 0/3 | 687ms |