नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

Inception: Mercury 2 vs inclusionAI: Ring-2.6-1T

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-03

मेट्रिक Mercury 2 Mercury 2 medium प्रकाशन: 2026-02-24 Ring-2.6-1T Ring-2.6-1T none प्रकाशन: 2026-05-10
स्कोअर 6.5 6.4
क्रमांक #89 #93
विश्वसनीयता 10.0 10.0
सुसंगतता 8.8 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 51.7% 50.0%
अस्थिर चाचण्या 3 2
एकूण रन 60 60
प्रति निकाल खर्च 0.611 0.000
एकूण खर्च $0.055 $0.026
इनपुट किंमत $0.250 / 1M $0.075 / 1M
आउटपुट किंमत $0.750 / 1M $0.625 / 1M
एकूण इनपुट टोकन्स 32,570 7,599
आउटपुट टोकन्स 4,022 39,954
रिझनिंग टोकन्स 58,405 0
प्रतिसाद वेळ (सरासरी) 2.27s 55.10s
प्रतिसाद वेळ (कमाल) 14.63s 143.82s
प्रतिसाद वेळ (एकूण) 43.20s 881.55s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 6.9 9.9 50.0% 0 1.12s 554 2,546 2,609
Ring-2.6-1T 9.2 8.4 91.7% 1 43.33s 810 5,575 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 7.2 6.5 66.7% 1 2.29s 4,519 270 8,514
Ring-2.6-1T 6.5 10.0 50.0% 0 143.82s 834 5,036 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 10.0 10.0 100.0% 0 3.28s 12,909 268 4,887
Ring-2.6-1T 3.0 10.0 0.0% 0 0ms 0 0 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 7.3 5.9 83.3% 1 1.11s 6,234 183 1,656
Ring-2.6-1T 3.0 10.0 0.0% 0 45.87s 2,712 1,529 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 2.9 7.2 11.1% 1 6.48s 695 41 30,754
Ring-2.6-1T 5.3 7.2 44.4% 1 73.40s 873 17,728 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 4.8 10.0 0.0% 0 821ms 456 137 542
Ring-2.6-1T 4.3 10.0 0.0% 0 15.63s 561 846 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 10.0 10.0 100.0% 0 1.07s 340 14 958
Ring-2.6-1T 9.8 10.0 100.0% 0 27.36s 774 2,004 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 5.4 10.0 33.3% 0 949ms 601 361 2,781
Ring-2.6-1T 7.7 10.0 66.7% 0 31.47s 792 3,469 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 10.0 10.0 100.0% 0 1.89s 6,080 180 1,956
Ring-2.6-1T 3.0 10.0 0.0% 0 0ms 0 0 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.0 10.0 0.0% 0 2.58s 182 22 3,748
Ring-2.6-1T 3.0 10.0 0.0% 0 133.60s 243 3,767 0

झटपट तुलना

तुलना जोडी बदला