स्वायत्त एजेंट कार्य रैंकिंग
देखें कि स्वायत्त एजेंट कार्य में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↓.
380/380
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | स्वायत्त एजेंट कार्य स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #259 | Space Bunny Alpha low | Stealth | 4.7 | 5.7 | $0.000 | 0/1 | 89.0s |
| #273 | North Mini Code medium | Cohere | 3.9 | 5.4 | $0.000 | 0/1 | 105.2s |
| #286 | Ling 3.0 Flash none | Inclusionai | 3.0 | 5.2 | $0.000 | 0/1 | 26ms |
| #299 | Dots 3 Note Preview none | Dots Studio | 3.9 | 5.0 | $0.000 | 0/1 | 45.7s |
| #316 | North Mini Code none | Cohere | 3.0 | 4.7 | $0.000 | 0/1 | 18.9s |
| #326 | Owl Alpha medium | Openrouter | 0.0 | 4.6 | $0.000 | 0/0 | 0ms |
| #328 | Owl Alpha none | Openrouter | 0.0 | 4.6 | $0.000 | 0/0 | 0ms |
| #337 | Cobuddy medium | Baidu | 3.0 | 4.4 | $0.000 | 0/1 | 173ms |
| #345 | Qwen3.6 Plus Preview medium | Qwen | 0.0 | 4.0 | $0.000 | 0/0 | 0ms |
| #348 | Hunter Alpha medium | OpenRouter | 0.0 | 3.9 | $0.000 | 0/0 | 0ms |
| #351 | Ling 3.0 Tiny none | Inclusionai | 3.0 | 3.8 | $0.000 | 0/1 | 23ms |
| #354 | Ling 3.0 Tiny high | Inclusionai | 3.0 | 3.7 | $0.000 | 0/1 | 28ms |
| #355 | Ling 3.0 Tiny low | Inclusionai | 3.0 | 3.7 | $0.000 | 0/1 | 21ms |
| #356 | Ling 3.0 Tiny medium | Inclusionai | 3.0 | 3.6 | $0.000 | 0/1 | 24ms |
| #359 | Elephant Alpha none | Openrouter | 0.0 | 3.6 | $0.000 | 0/0 | 0ms |