नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Trinity Large Preview vs inclusionAI: Ring-2.6-1T

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-03

मेट्रिक Trinity Large Preview Trinity Large Preview none रिलीज़: 2026-01-27 Ring-2.6-1T Ring-2.6-1T medium रिलीज़: 2026-05-10
स्कोर 4.7 7.0
रैंक #148 #74
विश्वसनीयता 10.0 10.0
संगति 9.3 8.7
सही परीक्षण
प्रति प्रयास पास दर 23.3% 63.3%
अस्थिर टेस्ट 2 3
कुल रन 60 60
प्रति परिणाम लागत 0.017 0.000
कुल लागत $0.008 $0.033
इनपुट कीमत $0.243 / 1M $0.075 / 1M
आउटपुट कीमत $0.243 / 1M $0.625 / 1M
कुल इनपुट टोकन 29,828 35,892
आउटपुट टोकन 2,169 21,752
रीजनिंग टोकन 0 42,754
प्रतिक्रिया समय (औसत) 2.98s 61.29s
प्रतिक्रिया समय (अधिकतम) 14.34s 304.19s
प्रतिक्रिया समय (कुल) 56.57s 1164.50s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.1 10.0 0.0% 0 2.07s 651 550 0
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 810 3,833 4,891
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 4.0 6.6 16.7% 1 14.34s 738 397 0
Ring-2.6-1T 6.5 10.0 50.0% 0 59.65s 834 1,369 3,985
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 12,053 294 0
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 14,823 324 6,088
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 6,900 186 0
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 8,046 840 1,937
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 738 25 0
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 873 9,744 15,013
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 4.5 10.0 0.0% 0 873ms 498 104 0
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 561 150 583
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.5 10.0 0.0% 0 822ms 678 63 0
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 774 266 1,831
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.6 7.7 11.1% 1 1.97s 669 265 0
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 792 697 2,479
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 6,699 267 0
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 8,136 234 1,531
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.0 10.0 0.0% 0 777ms 204 18 0
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 243 4,295 4,416

त्वरित तुलना

तुलना जोड़ी बदलें