स्वायत्त एजेंट कार्य रैंकिंग
देखें कि स्वायत्त एजेंट कार्य में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
380/380
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | स्वायत्त एजेंट कार्य स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #327 | Mimo V2 PRO none | Xiaomi | 0.0 | 4.6 | $0.045 | 0/0 | 0ms |
| #301 | KAT Coder AIR V2.5 low | Kwaipilot | 3.0 | 5.0 | $0.046 | 0/1 | 1.08s |
| #317 | Laguna S 2.1 none | Poolside | 5.4 | 4.7 | $0.047 | 0/1 | 149.3s |
| #343 | GLM 5 Turbo none | Z.ai | 0.0 | 4.2 | $0.047 | 0/0 | 0ms |
| #292 | Mistral Small 4 none | Mistral | 5.0 | 5.1 | $0.047 | 0/1 | 45.5s |
| #336 | Granite 4.2 8B none | IBM Granite | 5.0 | 4.4 | $0.047 | 0/1 | 49.2s |
| #294 | KAT Coder AIR V2.5 medium | Kwaipilot | 3.0 | 5.1 | $0.048 | 0/1 | 1.05s |
| #106 | GPT-6 Luna medium | OpenAI | 7.4 | 7.8 | $0.048 | 0/1 | 71.7s |
| #278 | Hy3 preview medium | Tencent | 0.0 | 5.3 | $0.049 | 0/0 | 0ms |
| #223 | DeepSeek V4 Flash 0423 none | DeepSeek | 10.0 | 6.3 | $0.050 | 1/1 | 92.9s |
| #323 | GLM 5V Turbo none | Z.ai | 0.0 | 4.6 | $0.052 | 0/0 | 0ms |
| #184 | GLM 5.3 Flash low | Z.ai | 10.0 | 6.6 | $0.052 | 1/1 | 59.7s |
| #113 | Qwen3.7 Flash low | Qwen | 10.0 | 7.7 | $0.053 | 1/1 | 106.7s |
| #229 | DeepSeek V4 Flash 0731 none | DeepSeek | 10.0 | 6.2 | $0.055 | 1/1 | 174.9s |
| #88 | DeepSeek V4 Flash 0423 high | DeepSeek | 10.0 | 8.1 | $0.056 | 1/1 | 148.1s |