নেভিগেশন
Advertise here

Trinity Large Thinking (high) vs Qwen3 Coder Next (medium)

Trinity Large Thinking (high) average score-এ এগিয়ে: 4.8 vs 4.6. Qwen3 Coder Next (medium)-এর benchmark খরচ কম: $0.034 vs $0.592. Qwen3 Coder Next (medium) দ্রুত: 9.07s vs 75.86s, pass rates 39.4% vs 25.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-10

তুলনা করা মডেল

র‍্যাঙ্ক
#288
মোট আউটপুট টোকেন
932,619
প্রতিক্রিয়া সময় (গড়)
75.86s
মোট খরচ
$0.592
র‍্যাঙ্ক
#299
মোট আউটপুট টোকেন
19,069
প্রতিক্রিয়া সময় (গড়)
9.07s
মোট খরচ
$0.034
প্রস্তাবিত মডেল Qwen3 Coder Next (medium)

Its score stays close to the best score here (4.6 vs 4.8), while costing about 17.9x less than Trinity Large Thinking (high).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking high প্রকাশ: 2026-07-28 Qwen3 Coder Next Qwen3 Coder Next medium প্রকাশ: 2026-02-03
স্কোর 4.8 4.6
র‍্যাঙ্ক #288 #299
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.2 8.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 39.4% 25.8%
অস্থির টেস্ট 8 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 12.473 1.058
মোট খরচ $0.592 $0.034
ইনপুট মূল্য $0.250 / 1M $0.120 / 1M
আউটপুট মূল্য $0.800 / 1M $0.800 / 1M
মোট ইনপুট টোকেন 101,776 148,203
আউটপুট টোকেন 276,367 19,069
রিজনিং টোকেন 656,252 0
প্রতিক্রিয়া সময় (গড়) 75.86s 9.07s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 510.21s 81.80s
প্রতিক্রিয়া সময় (মোট) 1668.93s 154.19s
প্যারামিটার 398B মোট (13B সক্রিয়) 80B মোট (3B সক্রিয়)
উপলভ্যতা ওজন উপলভ্য উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#288 Trinity Large Thinking

high
খরচ
$0.028
সময়
130.1s
টোকেন
34,387 tok

#299 Qwen3 Coder Next

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Qwen3 Coder Next 3.7 7.2 22.2% 1 924ms 7,185 336 0

দ্রুত তুলনা

তুলনার জুটি বদলান