Coding Ranking
See which AI models perform best on Coding, which ones stay reliable, and where the biggest gaps appear. Sort by: Response Time (avg) ↓.
408/408
Filter models
No models match the current search and filters.
| Rank | Model | Company | Coding Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #371 | Grok 4.1 Fast medium | X AI | 0.8 | 0.4 | $0.069 | 0/1 | 23.6s |
| #315 | KAT Coder AIR V2.5 medium | Kwaipilot | 0.4 | 0.5 | $0.048 | 0/3 | 23.4s |
| #81 | Gemini 3.5 Flash high | 1.0 | 0.8 | $2.737 | 3/3 | 23.0s | |
| #76 | Muse Spark 1.1 high | Meta | 1.0 | 0.8 | $2.570 | 3/3 | 22.9s |
| #55 | GPT-5.2 medium | OpenAI | 1.0 | 0.9 | $1.558 | 3/3 | 22.7s |
| #252 | KAT-Coder-Pro V2.5 default | Kwaipilot | 0.6 | 0.6 | $0.742 | 1/3 | 22.5s |
| #46 | Muse Spark 1.2 high | Meta | 1.0 | 0.9 | $2.018 | 3/3 | 22.2s |
| #211 | KAT-Coder-Pro V2.5 high | Kwaipilot | 0.6 | 0.6 | $0.506 | 1/3 | 22.0s |
| #338 | North Mini Code default | Cohere | 0.4 | 0.5 | $0.000 | 0/3 | 22.0s |
| #171 | Grok 4.6 low | X AI | 0.6 | 0.7 | $0.781 | 1/3 | 21.7s |
| #389 | Grok Build 0.1 none | X AI | 0.3 | 0.3 | $0.547 | 1/1 | 21.4s |
| #209 | GLM 5.3 low | Z.ai | 0.6 | 0.6 | $0.215 | 1/3 | 21.0s |
| #67 | Muse Spark 1.3 low | Meta | 0.8 | 0.9 | $0.911 | 2/3 | 20.9s |
| #142 | GLM 5.3 Flash high | Z.ai | 0.8 | 0.7 | $0.056 | 2/3 | 19.6s |
| #34 | GPT-5.3-Codex medium | OpenAI | 1.0 | 0.9 | $1.318 | 3/3 | 19.5s |