नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs OpenAI: GPT-5.4 Nano

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-29

मेट्रिक Mercury 2 Mercury 2 none प्रकाशन: 2026-02-24 GPT-5.4 Nano GPT-5.4 Nano none प्रकाशन: 2026-03-17
स्कोअर 4.8 4.5
क्रमांक #121 #128
विश्वसनीयता लागू नाही लागू नाही
सुसंगतता 9.0 7.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 27.8% 31.5%
अस्थिर चाचण्या 2 7
एकूण रन 54 54
प्रति निकाल खर्च 0.165 0.448
एकूण खर्च $0.007 $0.009
???? ??? $0.250 / 1M $0.200 / 1M
????? ??? $0.750 / 1M $1.250 / 1M
आउटपुट टोकन्स 1,625 2,762
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 613ms 1.40s
प्रतिसाद वेळ (कमाल) 1.27s 3.84s
प्रतिसाद वेळ (एकूण) 11.04s 25.14s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.0 10.0 0.0% 0 483ms 286 0
GPT-5.4 Nano 3.5 8.0 16.7% 1 1.18s 800 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.6 8.9 0.0% 0 969ms 310 0
GPT-5.4 Nano 7.1 3.7 66.7% 1 1.43s 577 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.0 10.0 0.0% 0 606ms 131 0
GPT-5.4 Nano 3.0 10.0 0.0% 0 3.84s 280 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 7.3 5.9 83.3% 1 667ms 180 0
GPT-5.4 Nano 6.5 10.0 50.0% 0 1.11s 219 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 5.3 7.2 44.4% 1 534ms 46 0
GPT-5.4 Nano 2.9 4.4 22.2% 2 926ms 52 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 4.8 10.0 0.0% 0 628ms 159 0
GPT-5.4 Nano 3.8 2.5 33.3% 1 1.31s 180 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 6.5 10.0 50.0% 0 551ms 82 0
GPT-5.4 Nano 5.0 6.8 33.3% 1 787ms 84 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.1 10.0 0.0% 0 533ms 234 0
GPT-5.4 Nano 3.7 7.3 22.2% 1 1.29s 348 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 10.0 10.0 100.0% 0 1.27s 197 0
GPT-5.4 Nano 10.0 10.0 100.0% 0 3.40s 222 0

झटपट तुलना

तुलना जोडी बदला