مشترکہ درجہ بندی
دیکھیں کہ مشترکہ میں کون سے AI ماڈلز بہترین کارکردگی دکھاتے ہیں، کون سے قابلِ اعتماد رہتے ہیں، اور سب سے بڑے فرق کہاں نظر آتے ہیں۔ ترتیب دیں حسب: ردِعمل کا وقت (اوسط) ↓.
216/216
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | مشترکہ اسکور | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #95 | Gemini 3.5 Flash-Lite low | 6.3 | 6.7 | $0.145 | 1/2 | 8.96s | |
| #189 | Trinity Large Preview none | Arcee AI | 1.5 | 4.8 | $0.008 | 0/1 | 8.91s |
| #91 | GPT-5.5 none | OpenAI | 6.5 | 6.9 | $0.544 | 1/2 | 8.90s |
| #87 | GPT-5.6 Sol none | OpenAI | 6.5 | 6.9 | $0.524 | 1/2 | 8.37s |
| #82 | Mercury 2 medium | Inception | 6.7 | 7.0 | $0.093 | 1/2 | 7.84s |
| #126 | Gemini 3.1 Flash Lite minimal | 3.0 | 6.1 | $0.047 | 0/2 | 7.75s | |
| #171 | Mistral Small 4 none | Mistral | 3.0 | 5.1 | $0.022 | 0/2 | 7.44s |
| #138 | GPT-5.6 Terra none | OpenAI | 2.9 | 6.0 | $0.349 | 0/2 | 7.02s |
| #165 | GPT-5.6 Luna none | OpenAI | 3.2 | 5.4 | $0.142 | 0/2 | 6.68s |
| #153 | Mimo V2 PRO none | Xiaomi | 1.5 | 5.6 | $0.045 | 0/1 | 6.58s |
| #151 | GLM 5V Turbo none | Z.ai | 1.5 | 5.6 | $0.052 | 0/1 | 6.51s |
| #197 | Grok 4.20 Beta none | X AI | 1.5 | 4.4 | $0.087 | 0/1 | 6.48s |
| #180 | GPT-4o-mini none | OpenAI | 3.0 | 5.0 | $0.010 | 0/2 | 6.32s |
| #112 | Gemini 3.1 Flash Lite Preview none | 3.0 | 6.4 | $0.052 | 0/2 | 6.23s | |
| #142 | GPT-5.4 Mini none | OpenAI | 6.5 | 5.9 | $0.095 | 1/2 | 6.22s |