नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Owl Alpha vs xAI: Grok 4.1 Fast

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-01

मेट्रिक Owl Alpha Owl Alpha medium रिलीज़: 2026-04-30 Grok 4.1 Fast Grok 4.1 Fast none रिलीज़: 2025-11-19
स्कोर 5.8 4.5
रैंक #92 #130
विश्वसनीयता 10.0 लागू नहीं
संगति 9.5 8.7
सही परीक्षण
प्रति प्रयास पास दर 40.7% 24.1%
अस्थिर टेस्ट 1 3
कुल रन 54 54
प्रति परिणाम लागत 0.000 0.269
कुल लागत $0.000 $0.009
???? ??? $0.000 / 1M $0.200 / 1M
????? ??? $0.000 / 1M $0.500 / 1M
आउटपुट टोकन 1,596 1,721
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 11.04s 1.76s
प्रतिक्रिया समय (अधिकतम) 58.63s 5.51s
प्रतिक्रिया समय (कुल) 198.65s 19.35s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 4.8 10.0 25.0% 0 3.97s 87 0
Grok 4.1 Fast 3.2 10.0 0.0% 0 1.07s 235 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 10.0 10.0 100.0% 0 7.35s 402 0
Grok 4.1 Fast 5.3 3.4 33.3% 1 1.79s 567 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 3.0 10.0 0.0% 0 10.01s 315 0
Grok 4.1 Fast 3.0 10.0 0.0% 0 3.33s 105 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 10.0 10.0 100.0% 0 21.64s 246 0
Grok 4.1 Fast 10.0 10.0 100.0% 0 943ms 180 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 5.3 10.0 33.3% 0 8.58s 28 0
Grok 4.1 Fast 5.9 7.2 55.6% 1 1.06s 15 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 4.3 10.0 0.0% 0 58.63s 98 0
Grok 4.1 Fast 4.4 9.9 0.0% 0 1.08s 112 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 6.3 10.0 50.0% 0 9.59s 57 0
Grok 4.1 Fast 3.0 10.0 0.0% 0 923ms 56 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 3.4 7.2 11.1% 1 3.44s 135 0
Grok 4.1 Fast 3.2 10.0 0.0% 0 1.28s 243 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 10.0 10.0 100.0% 0 8.26s 228 0
Grok 4.1 Fast 2.8 1.6 33.3% 1 5.51s 208 0

त्वरित तुलना

तुलना जोड़ी बदलें