پہیلی حل کرنا درجہ بندی
دیکھیں کہ پہیلی حل کرنا میں کون سے AI ماڈلز بہترین کارکردگی دکھاتے ہیں، کون سے قابلِ اعتماد رہتے ہیں، اور سب سے بڑے فرق کہاں نظر آتے ہیں۔ ترتیب دیں حسب: درست ٹیسٹس ↓.
210/210
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | پہیلی حل کرنا اسکور | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #94 | Claude Opus 4.7 none | Anthropic | 10.0 | 6.6 | $0.505 | 3/3 | 2.46s |
| #95 | Gemma 4 26B A4B medium | 10.0 | 6.6 | $0.089 | 3/3 | 5.79s | |
| #98 | Qwen3.6 Max Preview none | Qwen | 10.0 | 6.6 | $0.231 | 3/3 | 2.65s |
| #104 | Gemini 3.1 Flash Lite Preview low | 10.0 | 6.5 | $0.646 | 3/3 | 1.69s | |
| #105 | Gemini 3.1 Flash Lite low | 10.0 | 6.5 | $0.621 | 3/3 | 1.40s | |
| #106 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 3/3 | 900ms | |
| #110 | Gemma 4 31B medium | 9.9 | 6.3 | $0.163 | 3/3 | 26.9s | |
| #131 | Grok 4.20 Beta medium | X AI | 10.0 | 6.0 | $0.750 | 3/3 | 3.52s |
| #133 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 3/3 | 3.88s | |
| #157 | Mimo V2 Omni none | Xiaomi | 10.0 | 5.5 | $0.021 | 3/3 | 1.16s |
| #3 | GPT-5.6 Sol low | OpenAI | 8.2 | 9.5 | $0.971 | 2/3 | 3.44s |
| #4 | GPT-5.6 Sol medium | OpenAI | 8.2 | 9.4 | $1.316 | 2/3 | 2.98s |
| #9 | Gemini 3.5 Flash medium | 7.7 | 9.1 | $0.642 | 2/3 | 2.38s | |
| #13 | GPT-5.3-Codex medium | OpenAI | 9.0 | 8.9 | $0.920 | 2/3 | 5.05s |
| #16 | Muse Spark 1.1 medium | Meta | 7.9 | 8.6 | $1.357 | 2/3 | 42.5s |