AI BENCHY
Your ad here

AI BENCHY श्रेणी

सूचनांचे पालन क्रमवारी

सूचनांचे पालन मध्ये कोणती AI मॉडेल्स सर्वोत्तम काम करतात, कोणती विश्वासार्ह राहतात आणि सर्वात मोठी दरी कुठे दिसते ते पाहा. क्रम लावा: प्रतिसाद वेळ (सरासरी) ↓.

दाखवलेली मॉडेल्स

8

सरासरी सूचनांचे पालन स्कोअर

8.0

सर्वोत्तम मॉडेल

Kimi K2.5 10.0
क्रमांक मॉडेल कंपनी सूचनांचे पालन स्कोअर स्कोअर बरोबर चाचण्या प्रतिसाद वेळ (सरासरी)
#86 GPT-5.4 Mini none OpenAI 6.3 5.1 1/2 728ms
#79 Grok 4.20 Beta none X AI 4.8 5.3 0/2 687ms
#62 Gemini 2.5 Flash none Google 8.0 6.2 1/2 672ms
#70 Qwen3.5-122B-A10B none Qwen 4.5 5.7 0/2 585ms
#91 Mercury 2 none Inception 6.5 4.8 1/2 551ms
#90 Qwen3.5-9B none Qwen 6.5 4.8 1/2 514ms
#82 Grok 4.20 none X AI 4.8 5.2 0/2 455ms
#83 Mistral Small 4 none Mistral 6.5 5.2 1/2 380ms

सूचनांचे पालन स्कोअर नुसार शीर्ष मॉडेल्स

सूचनांचे पालन स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी) नुसार शीर्ष मॉडेल्स