नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs Inkling (low)

Inkling (low) average score में आगे है: 6.1 vs 6.0. Inkling (low) की benchmark लागत कम है: $0.187 vs $0.792. Inkling (low) तेज है: 5.15s vs 84.96s, pass rates 45.5% vs 54.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#150
कुल आउटपुट टोकन
1,002,646
प्रतिक्रिया समय (औसत)
84.96s
कुल लागत
$0.792
रैंक
#138
कुल आउटपुट टोकन
18,922
प्रतिक्रिया समय (औसत)
5.15s
कुल लागत
$0.187
अनुशंसित मॉडल Inkling (low)

It has the best score here (6.1), while costing about 4.2x less than Trinity Large Thinking (medium).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium रिलीज़: 2026-07-28 Inkling Inkling low रिलीज़: 2026-07-18
स्कोर 6.0 6.1
रैंक #150 #138
विश्वसनीयता 10.0 9.9
संगति 7.6 8.6
सही परीक्षण
प्रति प्रयास पास दर 45.5% 54.6%
अस्थिर टेस्ट 7 4
कुल रन 66 66
प्रति परिणाम लागत 11.308 1.866
कुल लागत $0.792 $0.187
इनपुट कीमत $0.220 / 1M $1.000 / 1M
आउटपुट कीमत $0.850 / 1M $4.050 / 1M
कुल इनपुट टोकन 118,477 109,884
आउटपुट टोकन 148,823 8,579
रीजनिंग टोकन 853,823 10,343
प्रतिक्रिया समय (औसत) 84.96s 5.15s
प्रतिक्रिया समय (अधिकतम) 525.14s 41.58s
प्रतिक्रिया समय (कुल) 1869.16s 113.39s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
लागत
$0.016
समय
75.9s
टोकन
19,401 tok

#138 Thinking Machines: Inkling

low
लागत
$0.002
समय
6.1s
टोकन
502 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Inkling 5.1 7.2 22.2% 1 8.71s 7,374 355 4,961

त्वरित तुलना

तुलना जोड़ी बदलें