Coding Ranking
See which AI models perform best on Coding, which ones stay reliable, and where the biggest gaps appear. Sort by: Response Time (avg) ↑.
330/330
Filter models
No models match the current search and filters.
| Rank | Model | Company | Coding Score | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #185 | Dots 3 Note Preview low | Dots Studio | 5.9 | 6.4 | $0.000 | 1/3 | 287.6s |
| #100 | Solar Pro 4 xhigh | Upstage | 5.8 | 7.6 | $0.150 | 1/3 | 292.2s |
| #186 | Dots 3 Note Preview high | Dots Studio | 5.8 | 6.4 | $0.000 | 1/3 | 306.2s |
| #218 | Dots 3 Note Preview medium | Dots Studio | 4.2 | 5.9 | $0.000 | 0/3 | 309.1s |
| #158 | Solar Pro 4 medium | Upstage | 5.5 | 6.8 | $0.140 | 1/3 | 310.4s |
| #226 | North Mini Code medium | Cohere | 4.5 | 5.7 | $0.000 | 0/3 | 320.4s |
| #79 | Kimi K3 max | Moonshot AI | 10.0 | 7.9 | $2.528 | 3/3 | 325.8s |
| #35 | Seed 2.1 Turbo high | Bytedance Seed | 10.0 | 8.9 | $1.797 | 3/3 | 336.0s |
| #209 | Trinity Large Thinking low | Arcee AI | 5.3 | 6.0 | $0.625 | 1/3 | 344.4s |
| #61 | Seed 2.1 Turbo medium | Bytedance Seed | 8.2 | 8.4 | $1.951 | 2/3 | 354.9s |
| #24 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 3/3 | 360.8s |
| #117 | LongCat 2.0 medium | Meituan | 10.0 | 7.4 | $0.499 | 3/3 | 455.0s |
| #167 | LongCat 2.0 low | Meituan | 6.6 | 6.7 | $0.412 | 1/3 | 479.3s |
| #170 | LongCat 2.0 high | Meituan | 7.8 | 6.7 | $0.492 | 2/3 | 505.3s |
| #299 | Granite 4.2 8B high | IBM Granite | 3.8 | 4.6 | $0.135 | 0/3 | 515.3s |