AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY श्रेणी

डोमेन-विशिष्ट क्रमवारी

डोमेन-विशिष्ट मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा. क्रम लावा: मेट्रिक ↑.

दाखवलेली मॉडेल्स

15

सरासरी डोमेन-विशिष्ट स्कोअर

4.8

सर्वोत्तम मॉडेल

GLM 5 Turbo 2.9
क्रमांक मॉडेल कंपनी डोमेन-विशिष्ट स्कोअर स्कोअर बरोबर चाचण्या प्रतिसाद वेळ (सरासरी)
#93 Qwen3.6 Plus Preview medium Qwen 3.0 6.3 0/3 22.1s
#98 GLM 5 none Z.ai 3.0 6.1 0/3 2.24s
#106 Grok 4.20 Beta none X AI 3.0 5.8 0/3 611ms
#115 Qwen3.5-27B none Qwen 3.0 5.7 0/3 540ms
#126 gpt-oss-120b none OpenAI 3.0 5.4 0/3 35.0s
#127 Grok 4.20 none X AI 3.0 5.4 0/3 687ms
#130 MiniMax M2.7 medium Minimax 3.0 5.3 0/3 19.0s
#136 Elephant Alpha medium Openrouter 3.0 5.1 0/3 925ms
#137 Elephant Alpha none Openrouter 3.0 5.1 0/3 927ms
#138 Ling-2.6-flash none Inclusionai 3.0 5.0 0/3 4.95s
#143 MiMo-V2.5 none Xiaomi 3.0 4.9 0/3 756ms
#147 GPT-4o-mini none OpenAI 3.0 4.8 0/3 637ms
#154 Qwen3.5-9B none Qwen 3.0 4.6 0/3 464ms
#159 Ling-2.6-1T none Inclusionai 3.0 4.3 0/3 1.04s
#163 Granite 4.1 8B none IBM Granite 3.0 4.0 0/3 357ms

डोमेन-विशिष्ट स्कोअर नुसार शीर्ष मॉडेल्स

डोमेन-विशिष्ट स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी) नुसार शीर्ष मॉडेल्स