स्वायत्त एजेंट कार्य रैंकिंग
देखें कि स्वायत्त एजेंट कार्य में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
380/380
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | स्वायत्त एजेंट कार्य स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #337 | Cobuddy medium | Baidu | 3.0 | 4.4 | $0.000 | 0/1 | 173ms |
| #345 | Qwen3.6 Plus Preview medium | Qwen | 0.0 | 4.0 | $0.000 | 0/0 | 0ms |
| #348 | Hunter Alpha medium | OpenRouter | 0.0 | 3.9 | $0.000 | 0/0 | 0ms |
| #351 | Ling 3.0 Tiny none | Inclusionai | 3.0 | 3.8 | $0.000 | 0/1 | 23ms |
| #354 | Ling 3.0 Tiny high | Inclusionai | 3.0 | 3.7 | $0.000 | 0/1 | 28ms |
| #355 | Ling 3.0 Tiny low | Inclusionai | 3.0 | 3.7 | $0.000 | 0/1 | 21ms |
| #356 | Ling 3.0 Tiny medium | Inclusionai | 3.0 | 3.6 | $0.000 | 0/1 | 24ms |
| #359 | Elephant Alpha none | Openrouter | 0.0 | 3.6 | $0.000 | 0/0 | 0ms |
| #360 | Elephant Alpha medium | Openrouter | 0.0 | 3.5 | $0.000 | 0/0 | 0ms |
| #361 | Hunter Alpha none | OpenRouter | 0.0 | 3.5 | $0.000 | 0/0 | 0ms |
| #371 | Command A+ none | Cohere | 3.0 | 3.0 | $0.000 | 0/1 | 1.05s |
| #373 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 0.0 | 2.7 | $0.000 | 0/0 | 0ms |
| #374 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 0.0 | 2.6 | $0.000 | 0/0 | 0ms |
| #379 | LFM2-24B-A2B none | Liquid | 0.0 | 1.8 | $0.001 | 0/0 | 0ms |
| #335 | Trinity Large Preview none | Arcee AI | 3.0 | 4.4 | $0.001 | 0/1 | 88ms |