AI BENCHY श्रेणी
संयुक्त रैंकिंग
देखें कि संयुक्त में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
189/189
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | संयुक्त स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #1 | Gemini 3.5 Flash high | 10.0 | 9.8 | $1.115 | 1/1 | 22.4s | |
| #2 | Gemini 3 Flash Preview medium | 10.0 | 9.6 | $0.667 | 1/1 | 22.4s | |
| #3 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.5 | $0.649 | 1/1 | 9.87s |
| #4 | Qwen3.7 Max medium | Qwen | 10.0 | 9.4 | $0.523 | 1/1 | 19.6s |
| #5 | GPT-5.6 Sol medium | OpenAI | 10.0 | 9.4 | $0.966 | 1/1 | 12.1s |
| #6 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.821 | 1/1 | 13.7s |
| #7 | GPT-5.5 low | OpenAI | 10.0 | 9.3 | $0.907 | 1/1 | 9.56s |
| #8 | Gemini 3.5 Flash low | 10.0 | 9.2 | $0.349 | 1/1 | 6.44s | |
| #9 | Claude Fable 5 medium | Anthropic | 10.0 | 9.2 | $3.165 | 1/1 | 33.7s |
| #11 | Gemini 3.5 Flash medium | 10.0 | 9.1 | $0.582 | 1/1 | 12.0s | |
| #12 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $3.679 | 1/1 | 19.3s |
| #13 | GPT-5.3-Codex medium | OpenAI | 10.0 | 8.9 | $0.740 | 1/1 | 19.6s |
| #14 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.9 | $0.960 | 1/1 | 121.5s |
| #16 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $0.679 | 1/1 | 21.4s |
| #17 | GLM 5.2 medium | Z.ai | 10.0 | 8.7 | $0.179 | 1/1 | 52.0s |