नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs Qwen3.5 Plus 2026-04-20

average score लगभग बराबर है: 6.0 vs 6.1. Qwen3.5 Plus 2026-04-20 की benchmark लागत कम है: $0.122 vs $0.656. Qwen3.5 Plus 2026-04-20 तेज है: 13.56s vs 96.78s, pass rates 48.5% vs 43.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#145
कुल आउटपुट टोकन
815,220
प्रतिक्रिया समय (औसत)
96.78s
कुल लागत
$0.656
रैंक
#141
कुल आउटपुट टोकन
51,487
प्रतिक्रिया समय (औसत)
13.56s
कुल लागत
$0.122
अनुशंसित मॉडल Qwen3.5 Plus 2026-04-20

It has the best score here (6.1), while costing about 5.4x less than Trinity Large Thinking (low).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking low रिलीज़: 2026-07-28 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none रिलीज़: 2026-04-20
स्कोर 6.0 6.1
रैंक #145 #141
विश्वसनीयता 9.7 10.0
संगति 7.9 8.7
सही परीक्षण
प्रति प्रयास पास दर 48.5% 43.9%
अस्थिर टेस्ट 6 4
कुल रन 66 66
प्रति परिणाम लागत 8.199 1.636
कुल लागत $0.656 $0.122
इनपुट कीमत $0.220 / 1M $0.300 / 1M
आउटपुट कीमत $0.850 / 1M $1.800 / 1M
कुल इनपुट टोकन 122,845 94,468
आउटपुट टोकन 117,704 51,487
रीजनिंग टोकन 697,516 0
प्रतिक्रिया समय (औसत) 96.78s 13.56s
प्रतिक्रिया समय (अधिकतम) 540.96s 206.05s
प्रतिक्रिया समय (कुल) 2129.13s 298.31s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
लागत
$0.021
समय
173.2s
टोकन
24,586 tok

#141 Qwen3.5 Plus 2026-04-20

none
लागत
$0.008
समय
77.0s
टोकन
4,369 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Qwen3.5 Plus 2026-04-20 3.9 7.8 11.1% 1 1.69s 7,913 480 0

त्वरित तुलना

तुलना जोड़ी बदलें