नेविगेशन
Advertise here

Trinity Large Thinking (low) vs Qwen3.6 27B

Qwen3.6 27B average score में आगे है: 6.3 vs 6.3. Qwen3.6 27B की benchmark लागत कम है: $0.147 vs $0.700. Qwen3.6 27B तेज है: 12.71s vs 95.16s, pass rates 47.8% vs 47.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#222
कुल आउटपुट टोकन
842,200
प्रतिक्रिया समय (औसत)
95.16s
कुल लागत
$0.700
रैंक
#213
कुल आउटपुट टोकन
20,816
प्रतिक्रिया समय (औसत)
12.71s
कुल लागत
$0.147
अनुशंसित मॉडल Qwen3.6 27B

It has the best score here (6.3), while costing about 4.8x less than Trinity Large Thinking (low).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking low रिलीज़: 2026-07-28 Qwen3.6 27B Qwen3.6 27B none रिलीज़: 2026-04-20
स्कोर 6.3 6.3
रैंक #222 #213
विश्वसनीयता 10.0 10.0
संगति 8.1 7.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 47.8% 47.8%
अस्थिर टेस्ट 6 6
कुल रन 69 69
प्रति परिणाम लागत 9.163 1.874
कुल लागत $0.700 $0.147
इनपुट कीमत $0.250 / 1M $0.320 / 1M
आउटपुट कीमत $0.800 / 1M $3.200 / 1M
कुल इनपुट टोकन 347,980 250,919
आउटपुट टोकन 121,898 20,816
रीजनिंग टोकन 720,302 0
प्रतिक्रिया समय (औसत) 95.16s 12.71s
प्रतिक्रिया समय (अधिकतम) 540.96s 156.31s
प्रतिक्रिया समय (कुल) 2188.74s 292.29s
पैरामीटर 398B कुल (13B सक्रिय) 27B
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#222 Trinity Large Thinking

low
लागत
$0.021
समय
173.2s
टोकन
24,586 tok

#213 Qwen3.6 27B

none
लागत
$0.009
समय
83.0s
टोकन
4,549 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

त्वरित तुलना

तुलना जोड़ी बदलें