Coding Ranking
See which AI models perform best on Coding, which ones stay reliable, and where the biggest gaps appear. Sort by: Total Cost ↑.
408/408
Filter models
No models match the current search and filters.
| Rank | Model | Company | Coding Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #17 | Gemini 3.7 Flash medium | 0.8 | 1.0 | $0.278 | 2/3 | 8.86s | |
| #123 | Muse Glimmer 30B medium | Meta | 0.8 | 0.8 | $0.288 | 2/3 | 33.7s |
| #274 | Mistral Large 4 none | Mistral | 0.5 | 0.6 | $0.290 | 0/3 | 85.0s |
| #248 | Inkling none | Thinkingmachines | 0.4 | 0.6 | $0.292 | 0/3 | 1.01s |
| #182 | Inkling low | Thinkingmachines | 0.5 | 0.7 | $0.293 | 0/3 | 8.71s |
| #56 | Qwen3.8 27B high | Qwen | 0.8 | 0.9 | ~$0.298 | 2/3 | 248.6s |
| #134 | DeepSeek V4 Flash 0731 low | DeepSeek | 0.7 | 0.7 | $0.306 | 1/3 | 163.3s |
| #214 | Qwen3.5-122B-A10B none | Qwen | 0.4 | 0.6 | $0.308 | 0/3 | 2.77s |
| #72 | GPT-5 Mini medium | OpenAI | 1.0 | 0.8 | $0.315 | 3/3 | 27.6s |
| #152 | Gemini 3.8 Flash low | 0.5 | 0.7 | $0.323 | 1/3 | 4.31s | |
| #241 | GLM 5 Turbo medium | Z.ai | 0.8 | 0.6 | $0.323 | 2/3 | 45.9s |
| #320 | MiniMax M2.7 medium | Minimax | 0.6 | 0.5 | $0.326 | 1/3 | 101.9s |
| #221 | MiMo-V2.5-Pro medium | Xiaomi | 0.6 | 0.6 | $0.332 | 1/3 | 92.1s |
| #310 | Mimo V2 PRO medium | Xiaomi | 0.6 | 0.5 | $0.333 | 1/3 | 94.2s |
| #44 | Gemini 3.6 Flash low | 0.8 | 0.9 | $0.363 | 2/3 | 6.95s |