کوڈنگ درجہ بندی
دیکھیں کہ کوڈنگ میں کون سے AI ماڈلز بہترین کارکردگی دکھاتے ہیں، کون سے قابلِ اعتماد رہتے ہیں، اور سب سے بڑے فرق کہاں نظر آتے ہیں۔ ترتیب دیں حسب: ردِعمل کا وقت (اوسط) ↑.
292/292
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | کوڈنگ اسکور | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #196 | GPT-5.4 Mini none | OpenAI | 5.5 | 5.9 | $0.095 | 1/3 | 913ms |
| #147 | Gemini 3.5 Flash Lite low | 4.3 | 6.6 | $0.138 | 0/3 | 917ms | |
| #265 | Qwen3 Coder Next medium | Qwen | 3.7 | 4.6 | $0.034 | 0/3 | 924ms |
| #175 | Gemini 3.1 Flash Lite none | 5.5 | 6.1 | $0.046 | 1/3 | 938ms | |
| #157 | Gemini 3.1 Flash Lite Preview none | 5.5 | 6.4 | $0.052 | 1/3 | 967ms | |
| #224 | GPT-5.6 Luna none | OpenAI | 3.8 | 5.4 | $0.029 | 0/3 | 980ms |
| #186 | GPT-5.6 Terra none | OpenAI | 5.5 | 6.0 | $0.280 | 1/3 | 1.00s |
| #236 | Inkling none | Thinkingmachines | 4.5 | 5.2 | $0.142 | 0/3 | 1.01s |
| #182 | Nemotron 3 Ultra none | NVIDIA | 5.5 | 6.1 | $0.095 | 1/3 | 1.02s |
| #264 | Mercury 2 none | Inception | 3.4 | 4.7 | $0.030 | 0/3 | 1.03s |
| #268 | Grok 4.20 Beta none | X AI | 1.8 | 4.4 | $0.087 | 0/1 | 1.14s |
| #219 | Qwen3.8 27B none | Qwen | 5.5 | 5.5 | ~$0.006 | 1/3 | 1.19s |
| #278 | Ling 3.0 Tiny none | Inclusionai | 4.2 | 4.0 | $0.000 | 0/3 | 1.19s |
| #274 | Grok 4.20 none | X AI | 1.1 | 4.1 | $0.057 | 0/1 | 1.22s |
| #290 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.3 | 3.2 | $0.000 | 1/1 | 1.27s |