नेविगेशन
Advertise here

Trinity Large Thinking (medium) vs MiMo-V2.6-Pro

MiMo-V2.6-Pro average score में आगे है: 6.2 vs 6.1. MiMo-V2.6-Pro की benchmark लागत कम है: $0.122 vs $0.756. MiMo-V2.6-Pro तेज है: 7.09s vs 85.44s, pass rates 48.5% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#214
कुल आउटपुट टोकन
1,016,785
प्रतिक्रिया समय (औसत)
85.44s
कुल लागत
$0.756
रैंक
#202
कुल आउटपुट टोकन
80,341
प्रतिक्रिया समय (औसत)
7.09s
कुल लागत
$0.122
अनुशंसित मॉडल MiMo-V2.6-Pro

It has the best score here (6.2), while costing about 6.2x less than Trinity Large Thinking (medium).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking medium रिलीज़: 2026-07-28 MiMo-V2.6-Pro MiMo-V2.6-Pro none रिलीज़: 2026-09-22
स्कोर 6.1 6.2
रैंक #214 #202
विश्वसनीयता 10.0 10.0
संगति 7.9 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 48.5% 45.5%
अस्थिर टेस्ट 6 2
कुल रन 66 66
प्रति परिणाम लागत 9.972 1.353
कुल लागत $0.756 $0.122
इनपुट कीमत $0.250 / 1M $0.435 / 1M
आउटपुट कीमत $0.800 / 1M $0.870 / 1M
कुल इनपुट टोकन 118,486 119,156
आउटपुट टोकन 156,166 80,341
रीजनिंग टोकन 860,619 0
प्रतिक्रिया समय (औसत) 85.44s 7.09s
प्रतिक्रिया समय (अधिकतम) 525.14s 106.86s
प्रतिक्रिया समय (कुल) 1879.75s 155.92s
पैरामीटर 398B कुल (13B सक्रिय) 1.02T कुल (42B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#214 Trinity Large Thinking

medium
लागत
$0.016
समय
75.9s
टोकन
19,401 tok

#202 MiMo-V2.6-Pro

none
लागत
$0.002
समय
14.8s
टोकन
2,260 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
MiMo-V2.6-Pro 5.6 9.9 33.3% 0 3.69s 7,440 4,344 0

त्वरित तुलना

तुलना जोड़ी बदलें