नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs Qwen3 Coder Next (medium)

Trinity Large Thinking (high) average score मध्ये पुढे आहे: 4.8 vs 4.6. Qwen3 Coder Next (medium) चा benchmark खर्च कमी आहे: $0.034 vs $0.592. Qwen3 Coder Next (medium) वेगवान आहे: 9.07s vs 75.86s, pass rates 39.4% vs 25.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-10

तुलना केलेली मॉडेल्स

क्रमांक
#288
एकूण आउटपुट टोकन्स
932,619
प्रतिसाद वेळ (सरासरी)
75.86s
एकूण खर्च
$0.592
क्रमांक
#299
एकूण आउटपुट टोकन्स
19,069
प्रतिसाद वेळ (सरासरी)
9.07s
एकूण खर्च
$0.034
शिफारस केलेले मॉडेल Qwen3 Coder Next (medium)

Its score stays close to the best score here (4.6 vs 4.8), while costing about 17.9x less than Trinity Large Thinking (high).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high प्रकाशन: 2026-07-28 Qwen3 Coder Next Qwen3 Coder Next medium प्रकाशन: 2026-02-03
स्कोअर 4.8 4.6
क्रमांक #288 #299
विश्वसनीयता 10.0 10.0
सुसंगतता 7.2 8.6
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 39.4% 25.8%
अस्थिर चाचण्या 8 4
एकूण रन 66 66
प्रति निकाल खर्च 12.473 1.058
एकूण खर्च $0.592 $0.034
इनपुट किंमत $0.250 / 1M $0.120 / 1M
आउटपुट किंमत $0.800 / 1M $0.800 / 1M
एकूण इनपुट टोकन्स 101,776 148,203
आउटपुट टोकन्स 276,367 19,069
रिझनिंग टोकन्स 656,252 0
प्रतिसाद वेळ (सरासरी) 75.86s 9.07s
प्रतिसाद वेळ (कमाल) 510.21s 81.80s
प्रतिसाद वेळ (एकूण) 1668.93s 154.19s
पॅरामीटर्स 398B एकूण (13B सक्रिय) 80B एकूण (3B सक्रिय)
उपलब्धता वेट्स उपलब्ध मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#288 Trinity Large Thinking

high
खर्च
$0.028
वेळ
130.1s
टोकन्स
34,387 tok

#299 Qwen3 Coder Next

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Qwen3 Coder Next 3.7 7.2 22.2% 1 924ms 7,185 336 0

झटपट तुलना

तुलना जोडी बदला