Coding Ranking
See which AI models perform best on Coding, which ones stay reliable, and where the biggest gaps appear. Sort by: Response Time (avg) ↑.
408/408
Filter models
No models match the current search and filters.
| Rank | Model | Company | Coding Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #50 | Qwen3.8 MAX low | Qwen | 0.8 | 0.9 | $1.089 | 2/3 | 28.7s |
| #2 | Gemini 3.8 Flash high | 1.0 | 1.0 | $1.927 | 3/3 | 29.3s | |
| #100 | Qwen3.8 Flash Next low | Qwen | 1.0 | 0.8 | ~$0.045 | 3/3 | 29.5s |
| #233 | Claude Opus 4.6 medium | Anthropic | 0.6 | 0.6 | $2.961 | 1/3 | 30.1s |
| #324 | Grok 4.20 Beta medium | X AI | 0.3 | 0.5 | $0.750 | 1/1 | 31.4s |
| #299 | Hy3 preview medium | Tencent | 0.5 | 0.5 | $0.049 | 1/3 | 31.4s |
| #286 | Ling 3.1 Flash none | Inclusionai | 0.5 | 0.5 | $0.000 | 0/3 | 31.9s |
| #240 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 0.8 | 0.6 | $0.669 | 2/3 | 33.1s |
| #217 | Claude Sonnet 4.6 medium | Anthropic | 0.6 | 0.6 | $2.126 | 1/3 | 33.3s |
| #123 | Muse Glimmer 30B medium | Meta | 0.8 | 0.8 | $0.288 | 2/3 | 33.7s |
| #53 | DeepSeek V4.1 Flash medium | DeepSeek | 1.0 | 0.9 | $0.591 | 3/3 | 34.4s |
| #245 | Gemini 3.5 Flash none | 0.9 | 0.6 | $1.752 | 2/3 | 34.7s | |
| #69 | Qwen3.7 Max medium | Qwen | 1.0 | 0.9 | $1.689 | 3/3 | 35.3s |
| #372 | Laguna M.1 medium | Poolside | 0.1 | 0.4 | $0.033 | 0/1 | 35.6s |
| #350 | Owl Alpha default | Openrouter | 0.6 | 0.5 | $0.000 | 1/3 | 36.9s |