AI BENCHY श्रेणी
Samanya Buddhimatta क्रमवारी
Samanya Buddhimatta मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा.
दाखवलेली मॉडेल्स
15
सरासरी Samanya Buddhimatta स्कोअर
6.1
सर्वोत्तम मॉडेल
Gemini 3 Flash Preview 10.0| क्रमांक | मॉडेल | कंपनी | Samanya Buddhimatta स्कोअर | स्कोअर | बरोबर चाचण्या | प्रतिसाद वेळ (सरासरी) |
|---|---|---|---|---|---|---|
| #1 | Gemini 3 Flash Preview medium | 10.0 | 10.0 | 1/1 | 4.09s | |
| #2 | Gemini 3.1 Pro Preview medium | 10.0 | 9.6 | 1/1 | 11.8s | |
| #3 | Claude Opus 4.7 medium | Anthropic | 10.0 | 9.2 | 1/1 | 2.87s |
| #4 | Claude Opus 4.7 none | Anthropic | 10.0 | 9.2 | 1/1 | 3.47s |
| #5 | Gemini 3 Flash Preview low | 10.0 | 8.8 | 1/1 | 3.68s | |
| #11 | Gemini 3.1 Flash Lite Preview high | 10.0 | 8.4 | 1/1 | 5.25s | |
| #12 | Gemini 3 PRO Preview medium | 10.0 | 8.4 | 1/1 | 9.34s | |
| #14 | Gemma 4 31B medium | 10.0 | 8.3 | 1/1 | 9.57s | |
| #17 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 8.2 | 1/1 | 3.16s | |
| #21 | Gemini 3 Flash Preview none | 10.0 | 8.1 | 1/1 | 1.13s | |
| #23 | MiMo-V2-Pro medium | Xiaomi | 10.0 | 8.1 | 1/1 | 4.06s |
| #24 | Gemma 4 26B A4B medium | 10.0 | 8.0 | 1/1 | 29.8s | |
| #25 | Grok 4.20 Beta medium | X AI | 10.0 | 8.0 | 1/1 | 5.78s |
| #26 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 8.0 | 1/1 | 4.94s |
| #31 | GLM 5V Turbo medium | Z.ai | 10.0 | 7.8 | 1/1 | 11.1s |