नेव्हिगेशन
AI BENCHY
तुलना करा चार्ट्स Paddhati
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs xAI: Grok 4.1 Fast

तुलना करा:

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-03-06

मेट्रिक Inception: Mercury 2 none प्रकाशन: 2026-02-24 xAI: Grok 4.1 Fast medium प्रकाशन: 2025-11-19
सरासरी स्कोअर 3.4 6.4
क्रमांक #50 #28
बरोबर चाचण्या
सुसंगतता 8.9 7.8
प्रति निकाल खर्च 0.147 0.541
एकूण खर्च $0.006 $0.049
प्रति प्रयत्न पास दर 33.3% 71.1%
अस्थिर चाचण्या 2 4
common.totalRuns 45 (15 x 3) 45 (15 x 3)
आउटपुट टोकन्स 1,144 1,056
रिझनिंग टोकन्स 0 80,419
प्रतिसाद वेळ (सरासरी) 594ms 27.61s
प्रतिसाद वेळ (कमाल) 1.27s 121.79s
प्रतिसाद वेळ (एकूण) 8.91s 220.87s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

सरासरी स्कोअर vs प्रतिसाद वेळ (सरासरी)

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 10.0 10.0 0.0% 0 466ms 274 0
xAI: Grok 4.1 Fast 10.0 10.0 100.0% 0 5.65s 102 4,021
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 10.0 10.0 0.0% 0 606ms 131 0
xAI: Grok 4.1 Fast 10.0 10.0 100.0% 0 37.64s 261 12,272
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 5.5 5.9 83.3% 1 667ms 180 0
xAI: Grok 4.1 Fast 9.9 10.0 100.0% 0 6.63s 180 5,409
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 4.0 7.2 44.4% 1 534ms 46 0
xAI: Grok 4.1 Fast 4.0 4.4 66.7% 2 121.79s 11 37,657
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 5.5 10.0 50.0% 0 551ms 82 0
xAI: Grok 4.1 Fast 5.5 10.0 50.0% 0 5.30s 55 3,489
Puzzle Solving स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 10.0 10.0 0.0% 0 533ms 234 0
xAI: Grok 4.1 Fast 4.0 7.2 44.4% 1 8.08s 187 6,086
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Inception: Mercury 2 10.0 10.0 100.0% 0 1.27s 197 0
xAI: Grok 4.1 Fast 10.0 1.6 33.3% 1 27.71s 260 11,485

झटपट तुलना

तुलना जोडी बदला