नेव्हिगेशन
AI BENCHY
तुलना करा चार्ट्स
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs xAI: Grok 4.1 Fast

तुलना करा:

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-03-05

मेट्रिक Inception: Mercury 2 medium प्रकाशन: 2026-02-24 xAI: Grok 4.1 Fast none प्रकाशन: 2025-11-19
क्रमांक #35 #53
सरासरी स्कोअर 5.4 2.9
बरोबर चाचण्या
सुसंगतता 8.3 8.9
प्रति निकाल खर्च 0.622 0.239
एकूण खर्च $0.044 $0.008
प्रति प्रयत्न पास दर 57.8% 26.7%
अस्थिर चाचण्या 3 2
common.totalAttempts 45 (15 x 3) 45 (15 x 3)
आउटपुट टोकन्स 3,571 1,036
रिझनिंग टोकन्स 45,379 0
प्रतिसाद वेळ (सरासरी) 2.47s 2.01s
प्रतिसाद वेळ (कमाल) 14.63s 5.51s
प्रतिसाद वेळ (एकूण) 34.56s 16.06s

स्कोअरनुसार शीर्ष मॉडेल्स

प्रतिसाद वेळ (सरासरी)

स्कोअर विरुद्ध एकूण खर्च

सरासरी स्कोअर vs प्रतिसाद वेळ (सरासरी)

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 7.3 9.8 66.7% 0 1.30s 2,531 2,410
xAI: Grok 4.1 Fast 1.3 10.0 0.0% 0 1.73s 229 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
xAI: Grok 4.1 Fast 10.0 10.0 0.0% 0 3.33s 105 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 5.5 5.9 83.3% 1 1.11s 183 1,656
xAI: Grok 4.1 Fast 9.9 10.0 100.0% 0 943ms 180 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 10.0 7.2 11.1% 1 6.48s 41 30,754
xAI: Grok 4.1 Fast 4.0 7.2 55.6% 1 1.06s 15 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
xAI: Grok 4.1 Fast 10.0 10.0 0.0% 0 923ms 56 0
Puzzle Solving स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 1.7 7.5 22.2% 1 934ms 354 2,758
xAI: Grok 4.1 Fast 1.3 10.0 0.0% 0 1.28s 243 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
xAI: Grok 4.1 Fast 10.0 1.6 33.3% 1 5.51s 208 0

झटपट तुलना

तुलना जोडी बदला