नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs Kimi K2.6

Trinity Large Thinking (medium) average score में आगे है: 6.0 vs 5.8. Kimi K2.6 की benchmark लागत कम है: $0.158 vs $0.792. Kimi K2.6 तेज है: 19.58s vs 84.96s, pass rates 45.5% vs 34.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#150
कुल आउटपुट टोकन
1,002,646
प्रतिक्रिया समय (औसत)
84.96s
कुल लागत
$0.792
रैंक
#155
कुल आउटपुट टोकन
30,253
प्रतिक्रिया समय (औसत)
19.58s
कुल लागत
$0.158
अनुशंसित मॉडल Kimi K2.6

Its score stays close to the best score here (5.8 vs 6.0), while costing about 5.0x less than Trinity Large Thinking (medium).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium रिलीज़: 2026-07-28 Kimi K2.6 Kimi K2.6 none रिलीज़: 2026-04-20
स्कोर 6.0 5.8
रैंक #150 #155
विश्वसनीयता 10.0 10.0
संगति 7.6 9.3
सही परीक्षण
प्रति प्रयास पास दर 45.5% 34.9%
अस्थिर टेस्ट 7 2
कुल रन 66 66
प्रति परिणाम लागत 11.308 3.199
कुल लागत $0.792 $0.158
इनपुट कीमत $0.220 / 1M $0.646 / 1M
आउटपुट कीमत $0.850 / 1M $2.720 / 1M
कुल इनपुट टोकन 118,477 116,970
आउटपुट टोकन 148,823 30,253
रीजनिंग टोकन 853,823 0
प्रतिक्रिया समय (औसत) 84.96s 19.58s
प्रतिक्रिया समय (अधिकतम) 525.14s 238.89s
प्रतिक्रिया समय (कुल) 1869.16s 430.85s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
लागत
$0.016
समय
75.9s
टोकन
19,401 tok

#155 MoonshotAI: Kimi K2.6

none
लागत
$0.020
समय
127.4s
टोकन
4,429 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0

त्वरित तुलना

तुलना जोड़ी बदलें