स्वायत्त एजेंट कार्य रैंकिंग
देखें कि स्वायत्त एजेंट कार्य में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
380/380
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | स्वायत्त एजेंट कार्य स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #123 | Qwen3.6 Flash medium | Qwen | 10.0 | 7.4 | $0.858 | 1/1 | 56.1s |
| #71 | Gemini 3.1 Pro Preview medium | 4.7 | 8.4 | $1.585 | 0/1 | 56.2s | |
| #8 | GPT-6 Astra xhigh | OpenAI | 10.0 | 9.9 | $6.213 | 1/1 | 56.7s |
| #46 | Muse Spark 1.2 medium | Meta | 10.0 | 8.9 | $1.590 | 1/1 | 56.7s |
| #53 | Muse Spark 1.2 low | Meta | 10.0 | 8.7 | $0.881 | 1/1 | 56.8s |
| #172 | GPT-6 Sol none | OpenAI | 5.0 | 6.8 | $0.551 | 0/1 | 57.0s |
| #13 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.6 | $0.609 | 1/1 | 57.1s |
| #48 | Claude Fable 5 medium | Anthropic | 10.0 | 8.9 | $5.089 | 1/1 | 57.1s |
| #19 | GPT-5.6 Sol medium | OpenAI | 10.0 | 9.5 | $0.763 | 1/1 | 57.3s |
| #185 | GPT-5.5 none | OpenAI | 5.0 | 6.6 | $1.212 | 0/1 | 57.5s |
| #202 | Gemini 3 Flash Preview none | 5.0 | 6.4 | $0.155 | 0/1 | 57.8s | |
| #159 | Grok 4.6 low | X AI | 5.0 | 6.9 | $0.781 | 0/1 | 58.0s |
| #249 | GPT-5.6 Terra none | OpenAI | 5.0 | 5.8 | $0.516 | 0/1 | 58.0s |
| #122 | GPT-5.6 Luna medium | OpenAI | 7.4 | 7.4 | $0.101 | 0/1 | 58.1s |
| #183 | GPT-5.6 Sol none | OpenAI | 5.0 | 6.7 | $0.472 | 0/1 | 58.3s |