कोडिंग रैंकिंग
देखें कि कोडिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
289/289
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | कोडिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #60 | Step 3.7 Flash medium | Stepfun | 8.8 | 7.9 | $0.495 | 2/3 | 27.4s |
| #4 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.5 | $0.496 | 3/3 | 11.3s |
| #94 | LongCat 2.0 medium | Meituan | 10.0 | 7.4 | $0.499 | 3/3 | 455.0s |
| #144 | Claude Opus 4.7 none | Anthropic | 3.3 | 6.6 | $0.505 | 1/1 | 2.84s |
| #106 | KAT-Coder-Pro V2.5 high | Kwaipilot | 6.4 | 7.2 | $0.506 | 1/3 | 22.0s |
| #66 | GPT-5.6 Terra medium | OpenAI | 6.1 | 7.8 | $0.523 | 1/3 | 7.19s |
| #85 | GPT 5.3 Chat none | OpenAI | 5.6 | 7.5 | $0.533 | 1/3 | 10.5s |
| #107 | Muse Glimmer 30B high | Meta | 8.8 | 7.2 | $0.535 | 2/3 | 96.0s |
| #25 | Gemini 3.5 Flash Lite high | 8.4 | 8.8 | $0.540 | 2/3 | 16.6s | |
| #119 | GPT-5.5 none | OpenAI | 5.5 | 7.0 | $0.544 | 1/3 | 1.35s |
| #278 | Grok Build 0.1 none | X AI | 3.3 | 4.0 | $0.547 | 1/1 | 21.4s |
| #168 | Claude Sonnet 5 none | Anthropic | 4.6 | 6.1 | $0.548 | 0/3 | 3.67s |
| #59 | GPT-5.2 Chat none | OpenAI | 8.8 | 7.9 | $0.594 | 2/3 | 9.82s |
| #149 | Gemini 3.1 Flash Lite low | 5.5 | 6.6 | $0.621 | 1/3 | 1.53s | |
| #252 | Trinity Large Thinking high | Arcee AI | 3.7 | 4.8 | $0.624 | 0/3 | 245.0s |