नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Trinity Large Preview vs Google: Gemini 3.5 Flash

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-03

मेट्रिक Trinity Large Preview Trinity Large Preview none रिलीज़: 2026-01-27 Gemini 3.5 Flash Gemini 3.5 Flash low रिलीज़: 2026-05-19
स्कोर 4.7 9.3
रैंक #148 #3
विश्वसनीयता 10.0 10.0
संगति 9.3 10.0
सही परीक्षण
प्रति प्रयास पास दर 23.3% 90.0%
अस्थिर टेस्ट 2 0
कुल रन 60 60
प्रति परिणाम लागत 0.017 1.582
कुल लागत $0.008 $0.285
इनपुट कीमत $0.243 / 1M $1.500 / 1M
आउटपुट कीमत $0.243 / 1M $9.000 / 1M
कुल इनपुट टोकन 29,828 33,935
आउटपुट टोकन 2,169 2,027
रीजनिंग टोकन 0 23,938
प्रतिक्रिया समय (औसत) 2.98s 2.98s
प्रतिक्रिया समय (अधिकतम) 14.34s 6.44s
प्रतिक्रिया समय (कुल) 56.57s 59.59s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.1 10.0 0.0% 0 2.07s 651 550 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 494 209 2,536
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 4.0 6.6 16.7% 1 14.34s 738 397 0
Gemini 3.5 Flash 6.8 10.0 50.0% 0 5.54s 5,115 452 6,839
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 12,053 294 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 12,873 351 3,050
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 6,900 186 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 7,548 279 1,164
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 738 25 0
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 633 12 4,538
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 4.5 10.0 0.0% 0 873ms 498 104 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 486 119 916
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.5 10.0 0.0% 0 822ms 678 63 0
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 615 71 1,652
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.6 7.7 11.1% 1 1.97s 669 265 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 558 288 2,150
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 6,699 267 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 5,457 234 403
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Preview 3.0 10.0 0.0% 0 777ms 204 18 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 156 12 690

त्वरित तुलना

तुलना जोड़ी बदलें