Orodha ya Mchanganyiko
Ona ni modeli gani za AI zinafanya vizuri zaidi katika Mchanganyiko, zipi zinabaki thabiti, na pengo kubwa liko wapi. Panga kwa: Kipimo ↑.
Sababu za kushindwa
216/216
Chuja miundo
Hakuna miundo inayolingana na utafutaji na vichujio vya sasa.
| Nafasi | Modeli | Kampuni | Alama ya Mchanganyiko | Alama | Jumla ya gharama | Majaribio sahihi | Muda wa majibu (wastani) |
|---|---|---|---|---|---|---|---|
| #52 | Grok Build 0.1 medium | X AI | 10.0 | 7.6 | $1.097 | 2/2 | 65.1s |
| #54 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.6 | $0.352 | 2/2 | 14.6s |
| #58 | GPT-5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.571 | 2/2 | 15.1s |
| #75 | Qwen3.7 Plus none | Qwen | 10.0 | 7.2 | $0.106 | 2/2 | 117.7s |
| #96 | LongCat 2.0 low | Meituan | 10.0 | 6.7 | $0.391 | 2/2 | 130.2s |
| #102 | LongCat 2.0 high | Meituan | 10.0 | 6.6 | $0.469 | 2/2 | 167.1s |