নেভিগেশন
Advertise here

Trinity Large Thinking (high) vs GLM 5

Trinity Large Thinking (high) average score-এ এগিয়ে: 5.7 vs 5.6. GLM 5-এর benchmark খরচ কম: $0.140 vs $0.794. GLM 5 দ্রুত: 8.74s vs 74.52s, pass rates 42.0% vs 40.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#253
মোট আউটপুট টোকেন
943,044
প্রতিক্রিয়া সময় (গড়)
74.52s
মোট খরচ
$0.794
র‍্যাঙ্ক
#262
মোট আউটপুট টোকেন
5,577
প্রতিক্রিয়া সময় (গড়)
8.74s
মোট খরচ
$0.140
প্রস্তাবিত মডেল GLM 5

Its score stays close to the best score here (5.6 vs 5.7), while costing about 5.7x less than Trinity Large Thinking (high).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking high প্রকাশ: 2026-07-28 GLM 5 GLM 5 none প্রকাশ: 2026-02-12
স্কোর 5.7 5.6
র‍্যাঙ্ক #253 #262
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.3 9.3
প্রচেষ্টা 69/69 66/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 42.0% 40.6%
অস্থির টেস্ট 8 1
মোট রান 69 66
প্রতি ফলাফলে খরচ 11.289 1.363
মোট খরচ $0.794 $0.140
ইনপুট মূল্য $0.250 / 1M $0.600 / 1M
আউটপুট মূল্য $0.800 / 1M $1.920 / 1M
ক্যাশ পড়ার মূল্য $0.060 / 1M $0.120 / 1M
ক্যাশ লেখার মূল্য প্রযোজ্য নয় প্রযোজ্য নয়
মোট ইনপুট টোকেন 283,116 190,675
আউটপুট টোকেন 277,920 5,577
রিজনিং টোকেন 665,124 0
প্রতিক্রিয়া সময় (গড়) 74.52s 8.74s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 510.21s 74.80s
প্রতিক্রিয়া সময় (মোট) 1713.90s 131.17s
প্যারামিটার 398B মোট (13B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা ওজন উপলভ্য উন্মুক্ত উৎস

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#253 Trinity Large Thinking

high
খরচ
$0.028
সময়
130.1s
টোকেন
34,387 tok

#262 GLM 5

none
খরচ
$0.007
সময়
32.1s
টোকেন
2,023 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0

দ্রুত তুলনা

তুলনার জুটি বদলান