AI BENCHY श्रेणी
कोडिंग रैंकिंग
देखें कि कोडिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
| रैंक | मॉडल | कंपनी | कोडिंग स्कोर | स्कोर | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|
| #46 | Gemini 3.1 Flash Lite Preview low | 6.8 | 7.6 | 1/2 | 1.56s | |
| #48 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 5.4 | 7.6 | 1/2 | 137.5s |
| #49 | MiMo-V2-Pro medium | Xiaomi | 7.5 | 7.6 | 1/2 | 94.2s |
| #50 | Claude Sonnet 4.6 medium | Anthropic | 6.9 | 7.6 | 1/2 | 33.9s |
| #52 | Gemini 3.1 Flash Lite Preview none | 6.8 | 7.5 | 1/2 | 1.06s | |
| #53 | Gemini 3.1 Flash Lite low | 6.8 | 7.4 | 1/2 | 1.71s | |
| #55 | GPT-5.3 Chat none | OpenAI | 6.9 | 7.4 | 1/2 | 10.5s |
| #56 | MiMo-V2.5 medium | Xiaomi | 6.9 | 7.4 | 1/2 | 64.5s |
| #57 | Kimi K2.6 medium | Moonshot AI | 6.5 | 7.4 | 1/2 | 118.2s |
| #59 | GLM 5V Turbo medium | Z.ai | 6.8 | 7.4 | 1/2 | 54.8s |
| #61 | GPT-5.4 Mini medium | OpenAI | 7.5 | 7.3 | 1/2 | 73.3s |
| #63 | Qwen3.5-35B-A3B medium | Qwen | 6.5 | 7.3 | 1/2 | 244.5s |
| #66 | Claude Opus 4.6 medium | Anthropic | 7.2 | 7.2 | 1/2 | 29.4s |
| #67 | GPT-5.4 Nano medium | OpenAI | 6.8 | 7.2 | 1/2 | 21.1s |
| #71 | Seed-2.0-Mini medium | Bytedance Seed | 6.8 | 7.1 | 1/2 | 220.5s |