Coding Ranking
See which AI models perform best on Coding, which ones stay reliable, and where the biggest gaps appear. Sort by: Response Time (avg) ↑.
404/404
Filter models
No models match the current search and filters.
| Rank | Model | Company | Coding Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #385 | MiMo-V2-Flash default | Xiaomi | 0.4 | 0.3 | $0.025 | 0/3 | 2.64s |
| #352 | Nemotron 3 Super none | NVIDIA | 0.3 | 0.4 | $0.016 | 0/3 | 2.64s |
| #346 | Mimo V2 PRO default | Xiaomi | 0.5 | 0.5 | $0.045 | 1/3 | 2.65s |
| #219 | Gemini 3.5 Flash minimal | 0.6 | 0.6 | $0.508 | 1/3 | 2.75s | |
| #351 | Mimo V2 Omni default | Xiaomi | 0.4 | 0.4 | $0.021 | 0/3 | 2.75s |
| #213 | Qwen3.5-122B-A10B none | Qwen | 0.4 | 0.6 | $0.308 | 0/3 | 2.77s |
| #256 | Seed-2.0-Lite none | Bytedance Seed | 0.6 | 0.6 | $0.114 | 1/3 | 2.83s |
| #289 | Claude Opus 4.7 none | Anthropic | 0.3 | 0.5 | $0.505 | 1/1 | 2.84s |
| #223 | LongCat 2.0 none | Meituan | 0.5 | 0.6 | $0.104 | 1/3 | 2.85s |
| #377 | Laguna M.1 default | Poolside | 0.2 | 0.4 | $0.009 | 0/1 | 2.93s |
| #300 | Qwen3.6 Max Preview none | Qwen | 0.4 | 0.5 | $0.228 | 0/3 | 3.12s |
| #342 | GLM 5V Turbo none | Z.ai | 0.5 | 0.5 | $0.052 | 1/3 | 3.13s |
| #327 | MiMo-V2.5 none | Xiaomi | 0.5 | 0.5 | $0.049 | 1/3 | 3.24s |
| #178 | Claude Opus 4.8 none | Anthropic | 0.5 | 0.7 | $2.334 | 1/3 | 3.29s |
| #261 | Claude Sonnet 5 none | Anthropic | 0.5 | 0.6 | $1.095 | 0/3 | 3.67s |