AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#145

Trinity Large Thinking

Arcee AI प्रकाशन: 2026-07-28 चाचणी तारीख: 2026-07-28 10:52 arcee-ai/trinity-large-thinking::low

सारांश

Trinity Large Thinking AI BENCHY वर 6.0 स्कोर करते आणि #145 वर आहे. याची reliability 9.7, pass rate 48.5%, एकूण खर्च $0.656, आणि सरासरी response time 96.78s आहे.

Trinity Large Thinking खास का आहे: हे अँटी-एआय युक्त्या मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #2 आहे; तर सूचनांचे पालन हा सर्वात कमकुवत भाग आहे, rank #13. हे असामान्यपणे जास्त reasoning tokens वापरते, ज्यामुळे runs हळू किंवा महाग होऊ शकतात.

सुसंगतता

7.9

एकूण आउटपुट टोकन्स

815,220

एकूण इनपुट टोकन्स

122,845

इनपुट किंमत

$0.220 / 1M

आउटपुट किंमत

$0.850 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 14

प्रति प्रयत्न पास दर: 48.5%

अस्थिर चाचण्या

6

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

96.78s

प्रतिसाद वेळ (कमाल): 540.96s

प्रतिसाद वेळ (एकूण): 2129.13s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
खर्च
$0.021
वेळ
173.2s
टोकन्स
24,586 tok

किंमत इतिहास

OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.

तारीख इनपुट किंमत आउटपुट किंमत
2026-07-28 10:55 $0.220 / 1M $0.850 / 1M

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 8.3 10.0
कोडिंग 5.3 10.0
संयुक्त 5.2 6.0
डेटा पार्सिंग आणि निष्कर्षण 7.3 5.8
डोमेन-विशिष्ट 2.9 4.4
Samanya Buddhimatta 10.0 10.0
सूचनांचे पालन 4.4 6.8
कोडी सोडवणे 6.3 7.9
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना केलेली मॉडेल्स