नेविगेशन
Advertise here

Trinity Large Thinking (medium) vs Inkling

average score लगभग बराबर है: 6.1 vs 6.1. Inkling की benchmark लागत कम है: $0.304 vs $0.820. Inkling तेज है: 5.30s vs 84.01s, pass rates 49.3% vs 31.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#232
कुल आउटपुट टोकन
1,033,971
प्रतिक्रिया समय (औसत)
84.01s
कुल लागत
$0.820
रैंक
#233
कुल आउटपुट टोकन
16,536
प्रतिक्रिया समय (औसत)
5.30s
कुल लागत
$0.304
अनुशंसित मॉडल Inkling

It has the best score here (6.1), while costing about 2.7x less than Trinity Large Thinking (medium).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium रिलीज़: 2026-07-28 Inkling Inkling none रिलीज़: 2026-07-18 निःशुल्क उपलब्ध
स्कोर 6.1 6.1
रैंक #232 #233
विश्वसनीयता 10.0 10.0
संगति 7.7 9.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 49.3% 31.9%
अस्थिर टेस्ट 7 1
कुल रन 69 69
प्रति परिणाम लागत 10.772 4.337
कुल लागत $0.820 $0.304
इनपुट कीमत $0.250 / 1M $1.000 / 1M
आउटपुट कीमत $0.800 / 1M $4.050 / 1M
कुल इनपुट टोकन 319,352 236,599
आउटपुट टोकन 158,447 16,536
रीजनिंग टोकन 875,524 0
प्रतिक्रिया समय (औसत) 84.01s 5.30s
प्रतिक्रिया समय (अधिकतम) 525.14s 48.02s
प्रतिक्रिया समय (कुल) 1932.24s 121.91s
पैरामीटर 398B कुल (13B सक्रिय) 975B कुल (41B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#232 Trinity Large Thinking

medium
लागत
$0.016
समय
75.9s
टोकन
19,401 tok

#233 Thinking Machines: Inkling

none
Provider returned error
लागत
$0.000
समय
5.3s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Inkling 4.5 10.0 0.0% 0 1.01s 7,356 436 0

त्वरित तुलना

तुलना जोड़ी बदलें