নেভিগেশন
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (low) vs GPT-5 Nano (medium)

Trinity Large Thinking (low) average score-এ এগিয়ে: 6.0 vs 6.0. GPT-5 Nano (medium)-এর benchmark খরচ কম: $0.118 vs $0.625. GPT-5 Nano (medium) দ্রুত: 54.20s vs 96.61s, pass rates 47.0% vs 54.5%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-10

তুলনা করা মডেল

র‍্যাঙ্ক
#208
মোট আউটপুট টোকেন
818,359
প্রতিক্রিয়া সময় (গড়)
96.61s
মোট খরচ
$0.625
র‍্যাঙ্ক
#213
মোট আউটপুট টোকেন
282,437
প্রতিক্রিয়া সময় (গড়)
54.20s
মোট খরচ
$0.118
প্রস্তাবিত মডেল GPT-5 Nano (medium)

Its score stays close to the best score here (6.0 vs 6.0), while costing about 5.3x less than Trinity Large Thinking (low).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking low প্রকাশ: 2026-07-28 GPT-5 Nano GPT-5 Nano medium প্রকাশ: 2025-08-07
স্কোর 6.0 6.0
র‍্যাঙ্ক #208 #213
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.3 6.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 47.0% 54.5%
অস্থির টেস্ট 5 9
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.221 1.472
মোট খরচ $0.625 $0.118
ইনপুট মূল্য $0.250 / 1M $0.050 / 1M
আউটপুট মূল্য $0.800 / 1M $0.400 / 1M
মোট ইনপুট টোকেন 122,854 94,944
আউটপুট টোকেন 119,810 12,037
রিজনিং টোকেন 698,549 270,400
প্রতিক্রিয়া সময় (গড়) 96.61s 54.20s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 540.96s 227.89s
প্রতিক্রিয়া সময় (মোট) 2125.51s 867.23s
প্যারামিটার 398B মোট (13B সক্রিয়) ~120B মোট (~5B সক্রিয়)
উপলভ্যতা ওজন উপলভ্য বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 Trinity Large Thinking

low
খরচ
$0.021
সময়
173.2s
টোকেন
24,586 tok

#213 GPT-5 Nano

medium
খরচ
$0.006
সময়
108.5s
টোকেন
13,209 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152

দ্রুত তুলনা

তুলনার জুটি বদলান