स्वायत्त एजेंट कार्य रैंकिंग
देखें कि स्वायत्त एजेंट कार्य में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
380/380
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | स्वायत्त एजेंट कार्य स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #214 | Gemini 3.5 Flash Lite low | 5.0 | 6.3 | $0.183 | 0/1 | 53.9s | |
| #177 | Qwen3.5-Flash none | Qwen | 10.0 | 6.7 | $0.089 | 1/1 | 53.8s |
| #279 | GPT-5.6 Luna none | OpenAI | 5.0 | 5.3 | $0.056 | 0/1 | 53.8s |
| #38 | Gemini 3.5 Flash low | 10.0 | 9.0 | $0.752 | 1/1 | 53.7s | |
| #7 | GPT-6 Astra high | OpenAI | 10.0 | 9.9 | $4.458 | 1/1 | 53.4s |
| #3 | GPT-6 Sol high | OpenAI | 10.0 | 9.9 | $0.921 | 1/1 | 53.3s |
| #41 | Gemini 3.5 Flash Lite high | 10.0 | 9.0 | $0.624 | 1/1 | 53.1s | |
| #160 | Gemini 3 Flash Preview low | 5.0 | 6.9 | $0.254 | 0/1 | 52.6s | |
| #232 | Trinity Large Thinking medium | Arcee AI | 6.1 | 6.1 | $0.820 | 0/1 | 52.5s |
| #378 | Gemini 3 Flash Preview high | 10.0 | 1.8 | $0.105 | 1/1 | 52.5s | |
| #75 | GLM 5.2 high | Z.ai | 10.0 | 8.4 | $1.620 | 1/1 | 52.4s |
| #274 | Hy4 preview low | Tencent | 4.7 | 5.4 | $1.670 | 0/1 | 52.4s |
| #199 | Grok 4.3 medium | X AI | 3.9 | 6.5 | $0.989 | 0/1 | 51.6s |
| #18 | GPT-6 Sol medium | OpenAI | 10.0 | 9.5 | $0.703 | 1/1 | 51.5s |
| #62 | Claude Sonnet 5.5 high | Anthropic | 10.0 | 8.6 | $1.175 | 1/1 | 51.5s |