नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Trinity Large Preview vs OpenAI: gpt-oss-120b

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-03

मेट्रिक Trinity Large Preview Trinity Large Preview none प्रकाशन: 2026-01-27 gpt-oss-120b gpt-oss-120b none प्रकाशन: 2025-08-05 मोफत उपलब्ध
स्कोअर 4.7 5.4
क्रमांक #148 #126
विश्वसनीयता 10.0 10.0
सुसंगतता 9.3 9.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 23.3% 38.6%
अस्थिर चाचण्या 2 2
एकूण रन 60 57
प्रति निकाल खर्च 0.017 0.168
एकूण खर्च $0.008 $0.010
इनपुट किंमत $0.243 / 1M $0.039 / 1M
आउटपुट किंमत $0.243 / 1M $0.180 / 1M
एकूण इनपुट टोकन्स 29,828 9,081
आउटपुट टोकन्स 2,169 51,664
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 2.98s 21.61s
प्रतिसाद वेळ (कमाल) 14.34s 113.71s
प्रतिसाद वेळ (एकूण) 56.57s 345.79s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 3.1 10.0 0.0% 0 2.07s 651 550 0
gpt-oss-120b 6.5 10.0 50.0% 0 32.84s 1,336 8,676 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 4.0 6.6 16.7% 1 14.34s 738 397 0
gpt-oss-120b 4.3 1.1 66.7% 1 9.57s 901 3,232 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 12,053 294 0
gpt-oss-120b 3.0 10.0 0.0% 0 0ms 0 0 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 6,900 186 0
gpt-oss-120b 6.5 10.0 50.0% 0 7.12s 2,421 598 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 738 25 0
gpt-oss-120b 3.0 10.0 0.0% 0 34.98s 1,294 29,483 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 4.5 10.0 0.0% 0 873ms 498 104 0
gpt-oss-120b 4.8 10.0 0.0% 0 10.79s 584 615 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 3.5 10.0 0.0% 0 822ms 678 63 0
gpt-oss-120b 9.8 10.0 100.0% 0 5.06s 1,043 1,940 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 3.6 7.7 11.1% 1 1.97s 669 265 0
gpt-oss-120b 6.0 7.2 55.6% 1 8.21s 1,188 3,982 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 6,699 267 0
gpt-oss-120b 3.0 10.0 0.0% 0 0ms 0 0 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 3.0 10.0 0.0% 0 777ms 204 18 0
gpt-oss-120b 3.0 10.0 0.0% 0 47.29s 314 3,138 0

झटपट तुलना

तुलना जोडी बदला