नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 5 vs Trinity Large Thinking (medium)

average score लगभग बराबर है: 6.1 vs 6.1. Claude Sonnet 5 की benchmark लागत कम है: $0.548 vs $0.798. Claude Sonnet 5 तेज है: 6.05s vs 85.44s, pass rates 40.9% vs 48.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-14

रैंक
#161
कुल आउटपुट टोकन
22,508
प्रतिक्रिया समय (औसत)
6.05s
कुल लागत
$0.548
रैंक
#169
कुल आउटपुट टोकन
1,016,785
प्रतिक्रिया समय (औसत)
85.44s
कुल लागत
$0.798
अनुशंसित मॉडल Claude Sonnet 5

It has the best score here (6.1), while responding about 14.1x faster than Trinity Large Thinking (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5 Claude Sonnet 5 none रिलीज़: 2026-06-30 Trinity Large Thinking Trinity Large Thinking medium रिलीज़: 2026-07-28
स्कोर 6.1 6.1
रैंक #161 #169
विश्वसनीयता 10.0 10.0
संगति 8.7 7.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 40.9% 48.5%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 7.817 9.972
कुल लागत $0.548 $0.798
इनपुट कीमत $2.000 / 1M $0.220 / 1M
आउटपुट कीमत $10.000 / 1M $0.850 / 1M
कुल इनपुट टोकन 161,032 118,486
आउटपुट टोकन 22,508 156,166
रीजनिंग टोकन 0 860,619
प्रतिक्रिया समय (औसत) 6.05s 85.44s
प्रतिक्रिया समय (अधिकतम) 33.39s 525.14s
प्रतिक्रिया समय (कुल) 132.99s 1879.75s
पैरामीटर ~1T कुल (~100B सक्रिय) 398B कुल (13B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#161 Claude Sonnet 5

none
लागत
$0.061
समय
53.7s
टोकन
6,172 tok

#169 Trinity Large Thinking

medium
लागत
$0.016
समय
75.9s
टोकन
19,401 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155

त्वरित तुलना

तुलना जोड़ी बदलें