नेविगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (high) vs Qwen3 Coder Next

Qwen3 Coder Next average score में आगे है: 5.1 vs 4.8. Qwen3 Coder Next की benchmark लागत कम है: $0.025 vs $0.632. Qwen3 Coder Next तेज है: 9.12s vs 77.22s, pass rates 39.4% vs 25.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#202
कुल आउटपुट टोकन
953,758
प्रतिक्रिया समय (औसत)
77.22s
कुल लागत
$0.632
रैंक
#186
कुल आउटपुट टोकन
11,808
प्रतिक्रिया समय (औसत)
9.12s
कुल लागत
$0.025
अनुशंसित मॉडल Qwen3 Coder Next

It has the best score here (5.1), while costing about 26.1x less than Trinity Large Thinking (high).

विस्तृत तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high रिलीज़: 2026-07-28 Qwen3 Coder Next Qwen3 Coder Next none रिलीज़: 2026-02-03
स्कोर 4.8 5.1
रैंक #202 #186
विश्वसनीयता 9.9 10.0
संगति 7.2 9.7
सही परीक्षण
प्रति प्रयास पास दर 39.4% 25.8%
अस्थिर टेस्ट 8 1
कुल रन 66 66
प्रति परिणाम लागत 12.640 0.488
कुल लागत $0.632 $0.025
इनपुट कीमत $0.220 / 1M $0.110 / 1M
आउटपुट कीमत $0.850 / 1M $0.800 / 1M
कुल इनपुट टोकन 101,767 134,218
आउटपुट टोकन 286,218 11,808
रीजनिंग टोकन 667,540 0
प्रतिक्रिया समय (औसत) 77.22s 9.12s
प्रतिक्रिया समय (अधिकतम) 510.21s 45.14s
प्रतिक्रिया समय (कुल) 1698.89s 145.94s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
लागत
$0.028
समय
130.1s
टोकन
34,387 tok

#186 Qwen3 Coder Next

none
अमान्य SVG
लागत
$0.058
समय
246.3s
टोकन
64,126 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Qwen3 Coder Next 4.6 7.9 22.2% 1 2.22s 7,442 621 0

त्वरित तुलना

तुलना जोड़ी बदलें