AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY श्रेणी

सूचनांचे पालन क्रमवारी

सूचनांचे पालन मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा. क्रम लावा: बरोबर चाचण्या ↓.

दाखवलेली मॉडेल्स

15

सरासरी सूचनांचे पालन स्कोअर

8.0

सर्वोत्तम मॉडेल

Gemini 3 Flash Preview 10.0
क्रमांक मॉडेल कंपनी सूचनांचे पालन स्कोअर स्कोअर बरोबर चाचण्या प्रतिसाद वेळ (सरासरी)
#77 GLM 5 Turbo none Z.ai 6.5 5.5 1/2 2.13s
#83 Mistral Small 4 none Mistral 6.5 5.2 1/2 380ms
#84 gpt-oss-120b none OpenAI 8.4 5.2 1/2 5.10s
#86 GPT-5.4 Mini none OpenAI 6.3 5.1 1/2 728ms
#90 Qwen3.5-9B none Qwen 6.5 4.8 1/2 514ms
#91 Mercury 2 none Inception 6.5 4.8 1/2 551ms
#93 GLM 4.7 Flash medium Z.ai 6.2 4.6 1/2 2.97s
#94 MiMo-V2-Flash none Xiaomi 6.5 4.5 1/2 857ms
#97 Qwen3.5-9B medium Qwen 6.4 4.4 1/2 17.1s
#60 Gemma 4 26B A4B none Google 4.4 6.2 0/2 1.08s
#67 Qwen3.5-27B none Qwen 4.8 5.9 0/2 815ms
#70 Qwen3.5-122B-A10B none Qwen 4.5 5.7 0/2 585ms
#78 Trinity Large Preview none Arcee AI 4.1 5.3 0/2 1.09s
#79 Grok 4.20 Beta none X AI 4.8 5.3 0/2 687ms
#80 MiniMax M2.7 medium Minimax 3.7 5.3 0/2 12.6s

सूचनांचे पालन स्कोअर नुसार शीर्ष मॉडेल्स

सूचनांचे पालन स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी) नुसार शीर्ष मॉडेल्स