নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs GPT-5.4

Trinity Large Thinking (medium) average score-এ এগিয়ে: 6.0 vs 5.8. GPT-5.4-এর benchmark খরচ কম: $0.397 vs $0.792. GPT-5.4 দ্রুত: 2.07s vs 84.96s, pass rates 45.5% vs 34.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#150
মোট আউটপুট টোকেন
1,002,646
প্রতিক্রিয়া সময় (গড়)
84.96s
মোট খরচ
$0.792
র‍্যাঙ্ক
#156
মোট আউটপুট টোকেন
8,321
প্রতিক্রিয়া সময় (গড়)
2.07s
মোট খরচ
$0.397
প্রস্তাবিত মডেল GPT-5.4

Its score stays close to the best score here (5.8 vs 6.0), while costing about 2.0x less than Trinity Large Thinking (medium).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking medium প্রকাশ: 2026-07-28 GPT-5.4 GPT-5.4 none প্রকাশ: 2026-03-05
স্কোর 6.0 5.8
র‍্যাঙ্ক #150 #156
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.6 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 45.5% 34.9%
অস্থির টেস্ট 7 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 11.308 5.663
মোট খরচ $0.792 $0.397
ইনপুট মূল্য $0.220 / 1M $2.500 / 1M
আউটপুট মূল্য $0.850 / 1M $15.000 / 1M
মোট ইনপুট টোকেন 118,477 108,632
আউটপুট টোকেন 148,823 8,321
রিজনিং টোকেন 853,823 0
প্রতিক্রিয়া সময় (গড়) 84.96s 2.07s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 525.14s 15.63s
প্রতিক্রিয়া সময় (মোট) 1869.16s 45.51s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
খরচ
$0.016
সময়
75.9s
টোকেন
19,401 tok

#156 GPT-5.4

none
খরচ
$0.026
সময়
18.1s
টোকেন
1,792 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0

দ্রুত তুলনা

তুলনার জুটি বদলান