स्वायत्त एजेंट कार्य रैंकिंग
देखें कि स्वायत्त एजेंट कार्य में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
380/380
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | स्वायत्त एजेंट कार्य स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #334 | KAT Coder AIR V2.5 none | Kwaipilot | 3.0 | 4.4 | $0.070 | 0/1 | 1.07s |
| #335 | Trinity Large Preview none | Arcee AI | 3.0 | 4.4 | $0.001 | 0/1 | 88ms |
| #337 | Cobuddy medium | Baidu | 3.0 | 4.4 | $0.000 | 0/1 | 173ms |
| #338 | Mercury 2 none | Inception | 3.0 | 4.4 | $0.033 | 0/1 | 9.00s |
| #340 | MiniMax M2.5 medium | Minimax | 3.0 | 4.3 | $0.359 | 0/1 | 600.8s |
| #351 | Ling 3.0 Tiny none | Inclusionai | 3.0 | 3.8 | $0.000 | 0/1 | 23ms |
| #352 | Granite 4.1 8b none | IBM Granite | 3.0 | 3.8 | $0.007 | 0/1 | 60ms |
| #353 | Nemotron 3.5 Lightning none | NVIDIA | 3.0 | 3.8 | $0.007 | 0/1 | 339.6s |
| #354 | Ling 3.0 Tiny high | Inclusionai | 3.0 | 3.7 | $0.000 | 0/1 | 28ms |
| #355 | Ling 3.0 Tiny low | Inclusionai | 3.0 | 3.7 | $0.000 | 0/1 | 21ms |
| #356 | Ling 3.0 Tiny medium | Inclusionai | 3.0 | 3.6 | $0.000 | 0/1 | 24ms |
| #371 | Command A+ none | Cohere | 3.0 | 3.0 | $0.000 | 0/1 | 1.05s |
| #77 | Gemini 3.5 Flash high | 3.4 | 8.3 | $2.737 | 0/1 | 87.3s | |
| #176 | Grok Build 0.1 medium | X AI | 3.4 | 6.7 | $1.419 | 0/1 | 69.0s |
| #296 | Laguna S 2.1 medium | Poolside | 3.4 | 5.0 | $0.080 | 0/1 | 165.0s |