कोडिंग रैंकिंग
देखें कि कोडिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
408/408
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | कोडिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #219 | Mercury 2.5 medium | Inception | 0.5 | 0.6 | $0.034 | 0/3 | 3.70s |
| #227 | Gemini 3.5 Flash Lite low | 0.4 | 0.6 | $0.183 | 0/3 | 917ms | |
| #231 | Qwen3.5 Plus 2026-02-15 none | Qwen | 0.4 | 0.6 | $0.176 | 0/3 | 2.05s |
| #237 | DeepSeek V4 Flash 0423 none | DeepSeek | 0.4 | 0.6 | $0.149 | 0/3 | 17.1s |
| #242 | DeepSeek V4 Flash 0731 none | DeepSeek | 0.4 | 0.6 | $0.053 | 0/3 | 1.72s |
| #244 | Claude Fable 5.1 low | Anthropic | 0.3 | 0.6 | $3.395 | 0/3 | 6.75s |
| #247 | Apodex 1.1 Mini low | Apodex | 0.5 | 0.6 | $0.000 | 0/3 | 48.8s |
| #248 | Inkling none | Thinkingmachines | 0.4 | 0.6 | $0.292 | 0/3 | 1.01s |
| #249 | Qwen3.5 Plus 2026-04-20 none | Qwen | 0.4 | 0.6 | $0.216 | 0/3 | 1.69s |
| #250 | Step 5 Preview medium | Stepfun | 0.3 | 0.6 | $4.136 | 0/3 | 363.9s |
| #253 | Apodex 1.1 Mini medium | Apodex | 0.4 | 0.6 | $0.000 | 0/3 | 51.0s |
| #263 | Claude Sonnet 5 none | Anthropic | 0.5 | 0.6 | $1.095 | 0/3 | 3.67s |
| #271 | Trinity Large Thinking high | Arcee AI | 0.4 | 0.6 | $0.794 | 0/3 | 245.0s |
| #274 | Mistral Large 4 none | Mistral | 0.5 | 0.6 | $0.290 | 0/3 | 85.0s |
| #275 | Seed 2.1 Turbo none | Bytedance Seed | 0.5 | 0.6 | $0.182 | 0/3 | 2.35s |