Anti-AI Tricks Ranking
See which AI models perform best on Anti-AI Tricks, which ones stay reliable, and where the biggest gaps appear. Sort by: Response Time (avg) ↑.
216/216
Filter models
No models match the current search and filters.
| Rank | Model | Company | Anti-AI Tricks Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #118 | Claude Sonnet 5 none | Anthropic | 5.3 | 6.3 | $0.548 | 1/4 | 3.60s |
| #101 | GLM 5.2 none | Z.ai | 8.3 | 6.6 | $0.128 | 3/4 | 3.70s |
| #155 | KAT-Coder-Air V2.5 medium | Kwaipilot | 8.7 | 5.6 | $0.048 | 3/4 | 3.79s |
| #26 | Claude Sonnet 5 medium | Anthropic | 10.0 | 8.3 | $0.922 | 4/4 | 3.80s |
| #202 | Hunter Alpha none | OpenRouter | 3.5 | 4.2 | $0.000 | 0/4 | 3.81s |
| #191 | Grok 4.1 Fast medium | X AI | 8.7 | 4.7 | $0.069 | 3/4 | 3.81s |
| #58 | GPT-5.3 Chat none | OpenAI | 6.7 | 7.5 | $0.571 | 2/4 | 3.86s |
| #3 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.742 | 4/4 | 3.88s | |
| #85 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 8.2 | 6.9 | $0.467 | 3/4 | 3.90s |
| #17 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.931 | 4/4 | 3.95s |
| #79 | Grok 4.20 medium | X AI | 8.2 | 7.1 | $0.777 | 3/4 | 3.95s |
| #152 | Owl Alpha medium | Openrouter | 4.8 | 5.6 | $0.000 | 1/4 | 3.97s |
| #71 | Step 3.7 Flash low | Stepfun | 8.7 | 7.3 | $0.454 | 3/4 | 4.02s |
| #86 | DeepSeek V4 Pro none | DeepSeek | 3.2 | 6.9 | $0.096 | 0/4 | 4.02s |
| #60 | GPT-5.4 Mini medium | OpenAI | 8.6 | 7.5 | $0.756 | 3/4 | 4.05s |