Coding Ranking
See which AI models perform best on Coding, which ones stay reliable, and where the biggest gaps appear. Sort by: Response Time (avg) ↑.
404/404
Filter models
No models match the current search and filters.
| Rank | Model | Company | Coding Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #106 | Qwen3.7 Max none | Qwen | 0.5 | 0.8 | $0.451 | 1/3 | 1.35s |
| #197 | GPT-5.5 none | OpenAI | 0.5 | 0.7 | $1.212 | 1/3 | 1.35s |
| #194 | GPT-5.6 Sol none | OpenAI | 0.5 | 0.7 | $0.795 | 1/3 | 1.39s |
| #227 | Gemini 3.1 Flash Lite Preview low | 0.5 | 0.6 | $0.736 | 1/3 | 1.39s | |
| #378 | Elephant Alpha default | Openrouter | 0.4 | 0.4 | $0.000 | 0/3 | 1.39s |
| #280 | Qwen3.5-35B-A3B none | Qwen | 0.5 | 0.6 | $0.120 | 1/3 | 1.39s |
| #313 | MiMo-V2.5-Pro none | Xiaomi | 0.4 | 0.5 | $0.135 | 0/3 | 1.41s |
| #228 | Gemini 3.1 Flash Lite low | 0.5 | 0.6 | $0.717 | 1/3 | 1.53s | |
| #372 | Nemotron 3.5 Lightning none | NVIDIA | 0.3 | 0.4 | $0.009 | 0/3 | 1.55s |
| #263 | Qwen3.7 Flash none | Qwen | 0.5 | 0.6 | $0.028 | 1/3 | 1.55s |
| #277 | GPT-5.4 none | OpenAI | 0.5 | 0.6 | $0.690 | 1/3 | 1.62s |
| #319 | GPT-4o-mini default | OpenAI | 0.3 | 0.5 | $0.024 | 0/3 | 1.63s |
| #264 | Qwen3.8 Flash Next none | Qwen | 0.5 | 0.6 | ~$0.011 | 1/3 | 1.64s |
| #248 | Qwen3.5 Plus 2026-04-20 none | Qwen | 0.4 | 0.6 | $0.216 | 0/3 | 1.69s |
| #241 | DeepSeek V4 Flash 0731 none | DeepSeek | 0.4 | 0.6 | $0.053 | 0/3 | 1.72s |