स्वायत्त एजेंट कार्य रैंकिंग
देखें कि स्वायत्त एजेंट कार्य में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
380/380
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | स्वायत्त एजेंट कार्य स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $1.512 | 1/1 | 65.6s | |
| #2 | Gemini 3.8 Flash high | 10.0 | 9.9 | $1.927 | 1/1 | 115.5s | |
| #3 | GPT-6 Sol high | OpenAI | 10.0 | 9.9 | $0.921 | 1/1 | 53.3s |
| #4 | GPT-6.1 Sol max | OpenAI | 10.0 | 9.9 | $1.006 | 1/1 | 80.2s |
| #5 | GPT-6 Astra max | OpenAI | 10.0 | 9.9 | $5.044 | 1/1 | 69.6s |
| #6 | GPT-6.1 Sol xhigh | OpenAI | 10.0 | 9.9 | $1.377 | 1/1 | 58.9s |
| #7 | GPT-6 Astra high | OpenAI | 10.0 | 9.9 | $4.458 | 1/1 | 53.4s |
| #8 | GPT-6 Astra xhigh | OpenAI | 10.0 | 9.9 | $6.213 | 1/1 | 56.7s |
| #9 | Gemini 3.7 Flash high | 10.0 | 9.8 | $0.851 | 1/1 | 78.5s | |
| #10 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.970 | 1/1 | 61.8s | |
| #11 | GPT-6.1 Sol medium | OpenAI | 10.0 | 9.6 | $0.530 | 1/1 | 51.0s |
| #12 | GPT-6.1 Sol high | OpenAI | 10.0 | 9.6 | $0.755 | 1/1 | 54.6s |
| #13 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.6 | $0.609 | 1/1 | 57.1s |
| #14 | GPT-6 Astra low | OpenAI | 10.0 | 9.6 | $2.160 | 1/1 | 49.2s |
| #15 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.876 | 1/1 | 59.2s |