Coding Ranking
See which AI models perform best on Coding, which ones stay reliable, and where the biggest gaps appear. Sort by: Metric ↑.
404/404
Filter models
No models match the current search and filters.
| Rank | Model | Company | Coding Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #164 | GPT-5.2 Chat default | OpenAI | 0.9 | 0.7 | $0.594 | 2/3 | 9.82s |
| #165 | Qwen3.6 Max Preview medium | Qwen | 0.9 | 0.7 | $1.132 | 2/3 | 146.5s |
| #244 | Gemini 3.5 Flash none | 0.9 | 0.6 | $1.752 | 2/3 | 34.7s | |
| #135 | Seed-2.0-Code medium | Bytedance Seed | 0.9 | 0.7 | $1.275 | 2/3 | 89.9s |
| #68 | Claude Sonnet 5 medium | Anthropic | 0.9 | 0.9 | $1.438 | 2/3 | 17.3s |
| #364 | Qwen3.6 Plus Preview medium | Qwen | 1.0 | 0.4 | $0.000 | 0/1 | 0ms |
| #367 | Hunter Alpha medium | OpenRouter | 1.0 | 0.4 | $0.000 | 0/1 | 0ms |
| #380 | Hunter Alpha default | OpenRouter | 1.0 | 0.3 | $0.000 | 0/1 | 0ms |
| #398 | Step 3.5 Flash none | Stepfun | 1.0 | 0.2 | $0.020 | 0/1 | 0ms |
| #1 | Gemini 3.6 Flash high | 1.0 | 1.0 | $0.900 | 3/3 | 26.3s | |
| #2 | Gemini 3.8 Flash high | 1.0 | 1.0 | $1.927 | 3/3 | 29.3s | |
| #3 | GPT-6 Sol high | OpenAI | 1.0 | 1.0 | $0.921 | 3/3 | 19.1s |
| #4 | GPT-6.1 Sol max | OpenAI | 1.0 | 1.0 | $1.006 | 3/3 | 13.6s |
| #5 | GPT-6 Astra max | OpenAI | 1.0 | 1.0 | $5.044 | 3/3 | 14.6s |
| #6 | GPT-6.1 Sol xhigh | OpenAI | 1.0 | 1.0 | $1.377 | 3/3 | 10.6s |