नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Hunter Alpha vs xAI: Grok 4.20 Beta

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-03-12

मेट्रिक Hunter Alpha Hunter Alpha none प्रकाशन: प्रकाशन तारीख अज्ञात Grok 4.20 Beta Grok 4.20 Beta none प्रकाशन: 2026-03-12
क्रमांक #50 #52
सरासरी स्कोअर 4.6 4.4
सुसंगतता 8.0 9.1
प्रति निकाल खर्च 0.000 2.214
एकूण खर्च $0.000 $0.089
बरोबर चाचण्या
प्रति प्रयत्न पास दर 52.1% 33.3%
अस्थिर चाचण्या 4 2
एकूण रन 48 48
आउटपुट टोकन्स 2,272 1,511
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 4.64s 1.22s
प्रतिसाद वेळ (कमाल) 15.17s 6.48s
प्रतिसाद वेळ (एकूण) 74.24s 19.53s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

सरासरी स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

सरासरी स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Hunter Alpha 1.3 7.4 22.2% 1 3.85s 773 0
Grok 4.20 Beta 3.3 7.9 22.2% 1 562ms 245 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Hunter Alpha 10.0 10.0 0.0% 0 15.17s 379 0
Grok 4.20 Beta 10.0 10.0 0.0% 0 6.48s 282 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Hunter Alpha 9.9 10.0 100.0% 0 8.49s 249 0
Grok 4.20 Beta 9.9 10.0 100.0% 0 601ms 197 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Hunter Alpha 4.0 10.0 33.3% 0 2.33s 27 0
Grok 4.20 Beta 10.0 10.0 0.0% 0 611ms 160 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Hunter Alpha 5.0 3.1 66.7% 1 2.71s 91 0
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Hunter Alpha 5.0 10.0 50.0% 0 2.82s 69 0
Grok 4.20 Beta 4.5 10.0 0.0% 0 687ms 60 0
Puzzle Solving स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Hunter Alpha 4.0 4.4 66.7% 2 3.06s 349 0
Grok 4.20 Beta 4.0 7.2 55.6% 1 541ms 291 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Hunter Alpha 10.0 10.0 100.0% 0 6.02s 335 0
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

झटपट तुलना

तुलना जोडी बदला