AI BENCHY
Advertise here
#202

Trinity Large Thinking

Arcee AI रिलीज़: 2026-07-28 परीक्षण किया गया: 2026-07-28 10:47 arcee-ai/trinity-large-thinking::high
(high) (medium) (low)

सारांश

Trinity Large Thinking AI BENCHY पर 4.8 स्कोर करता है और #202 पर है। इसकी reliability 9.9, pass rate 39.4%, कुल लागत $0.632, और औसत response time 77.22s है।

Trinity Large Thinking को अलग क्या बनाता है: यह असामान्य रूप से अधिक reasoning tokens इस्तेमाल करता है, जिससे धीमे या महंगे runs समझ में आ सकते हैं।

संगति

7.2

कुल आउटपुट टोकन

953,758

कुल इनपुट टोकन

101,767

इनपुट कीमत

$0.220 / 1M

आउटपुट कीमत

$0.850 / 1M

सही परीक्षण

गलत टेस्ट: 17

प्रति प्रयास पास दर: 39.4%

अस्थिर टेस्ट

8

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

77.22s

प्रतिक्रिया समय (अधिकतम): 510.21s

प्रतिक्रिया समय (कुल): 1698.89s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
लागत
$0.028
समय
130.1s
टोकन
34,387 tok

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत
2026-07-28 10:55 $0.220 / 1M $0.850 / 1M

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 6.7 8.1
कोडिंग 3.7 4.7
संयुक्त 3.0 10.0
डेटा पार्सिंग और निष्कर्षण 6.3 5.8
डोमेन-विशिष्ट 2.9 7.2
Samanya Buddhimatta 6.5 3.4
निर्देश पालन 6.3 10.0
पहेली समाधान 4.7 5.2
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल