اینٹی اے آئی چالیں درجہ بندی
دیکھیں کہ اینٹی اے آئی چالیں میں کون سے AI ماڈلز بہترین کارکردگی دکھاتے ہیں، کون سے قابلِ اعتماد رہتے ہیں، اور سب سے بڑے فرق کہاں نظر آتے ہیں۔ ترتیب دیں حسب: ردِعمل کا وقت (اوسط) ↓.
210/210
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | اینٹی اے آئی چالیں اسکور | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #136 | GPT-5.4 Mini none | OpenAI | 3.1 | 5.9 | $0.095 | 0/4 | 929ms |
| #159 | GPT-5.6 Luna none | OpenAI | 4.8 | 5.4 | $0.142 | 1/4 | 901ms |
| #88 | Gemini 3.5 Flash minimal | 6.5 | 6.8 | $0.300 | 2/4 | 892ms | |
| #201 | Granite 4.1 8B none | IBM Granite | 4.9 | 4.0 | $0.007 | 1/4 | 844ms |
| #103 | Qwen3.5-27B none | Qwen | 4.8 | 6.5 | $0.090 | 1/4 | 788ms |
| #160 | Laguna XS 2.1 none | Poolside | 5.3 | 5.3 | $0.008 | 1/4 | 755ms |
| #192 | Laguna M.1 none | Poolside | 3.4 | 4.4 | $0.009 | 0/4 | 705ms |
| #191 | Grok 4.20 Beta none | X AI | 4.0 | 4.4 | $0.087 | 0/4 | 597ms |
| #208 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 4.8 | 3.2 | $0.000 | 1/4 | 584ms |
| #118 | Gemini 2.5 Flash none | 3.0 | 6.2 | $0.017 | 0/4 | 582ms | |
| #205 | Laguna Xs.2 none | Poolside | 3.0 | 3.8 | $0.004 | 0/4 | 534ms |
| #197 | Grok 4.20 none | X AI | 4.8 | 4.1 | $0.057 | 1/4 | 501ms |
| #189 | Mercury 2 none | Inception | 3.0 | 4.6 | $0.030 | 0/4 | 483ms |
| #210 | LFM2-24B-A2B none | Liquid | 2.5 | 2.2 | $0.001 | 0/3 | 471ms |
| #165 | Mistral Small 4 none | Mistral | 3.4 | 5.1 | $0.022 | 0/4 | 395ms |