कोडिंग रैंकिंग
देखें कि कोडिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
408/408
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | कोडिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #34 | GPT-5.3-Codex medium | OpenAI | 1.0 | 0.9 | $1.318 | 3/3 | 19.5s |
| #116 | Grok 4.5 low | X AI | 1.0 | 0.8 | $1.345 | 3/3 | 13.7s |
| #6 | GPT-6.1 Sol xhigh | OpenAI | 1.0 | 1.0 | $1.377 | 3/3 | 10.6s |
| #130 | Mistral Large 4 high | Mistral | 0.3 | 0.8 | $1.391 | 0/3 | 1277.8s |
| #188 | Grok Build 0.1 medium | X AI | 0.6 | 0.7 | $1.419 | 1/3 | 108.5s |
| #68 | Claude Sonnet 5 medium | Anthropic | 0.9 | 0.9 | $1.438 | 2/3 | 17.3s |
| #131 | Seed-2.0-Code high | Bytedance Seed | 0.6 | 0.7 | $1.448 | 1/3 | 266.7s |
| #203 | Step 3.7 Flash high | Stepfun | 0.4 | 0.7 | $1.478 | 0/3 | 206.2s |
| #168 | Ember-1 low | Fireworks | 1.0 | 0.7 | $1.488 | 3/3 | 37.9s |
| #62 | Claude Sonnet 5.5 xhigh | Anthropic | 0.8 | 0.9 | $1.516 | 2/3 | 11.9s |
| #37 | Pareto default | Unbiased | 1.0 | 0.9 | $1.520 | 3/3 | 50.1s |
| #128 | GLM 5.1 medium | Z.ai | 0.5 | 0.8 | $1.546 | 0/3 | 109.6s |
| #55 | GPT-5.2 medium | OpenAI | 1.0 | 0.9 | $1.558 | 3/3 | 22.7s |
| #74 | Gemini 3.1 Pro Preview medium | 0.8 | 0.8 | $1.585 | 2/3 | 40.2s | |
| #47 | Muse Spark 1.2 medium | Meta | 1.0 | 0.9 | $1.590 | 3/3 | 17.5s |