নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs GPT-5.4 Mini

Trinity Large Thinking (medium) average score-এ এগিয়ে: 6.0 vs 5.9. GPT-5.4 Mini-এর benchmark খরচ কম: $0.095 vs $0.792. GPT-5.4 Mini দ্রুত: 1.53s vs 84.96s, pass rates 45.5% vs 33.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#150
মোট আউটপুট টোকেন
1,002,646
প্রতিক্রিয়া সময় (গড়)
84.96s
মোট খরচ
$0.792
র‍্যাঙ্ক
#153
মোট আউটপুট টোকেন
7,880
প্রতিক্রিয়া সময় (গড়)
1.53s
মোট খরচ
$0.095
প্রস্তাবিত মডেল GPT-5.4 Mini

Its score stays close to the best score here (5.9 vs 6.0), while costing about 8.4x less than Trinity Large Thinking (medium).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking medium প্রকাশ: 2026-07-28 GPT-5.4 Mini GPT-5.4 Mini none প্রকাশ: 2026-03-17
স্কোর 6.0 5.9
র‍্যাঙ্ক #150 #153
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 45.5% 33.3%
অস্থির টেস্ট 7 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 11.308 1.580
মোট খরচ $0.792 $0.095
ইনপুট মূল্য $0.220 / 1M $0.750 / 1M
আউটপুট মূল্য $0.850 / 1M $4.500 / 1M
মোট ইনপুট টোকেন 118,477 79,067
আউটপুট টোকেন 148,823 7,880
রিজনিং টোকেন 853,823 0
প্রতিক্রিয়া সময় (গড়) 84.96s 1.53s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 525.14s 9.92s
প্রতিক্রিয়া সময় (মোট) 1869.16s 33.74s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
খরচ
$0.016
সময়
75.9s
টোকেন
19,401 tok

#153 GPT-5.4 Mini

none
খরচ
$0.010
সময়
11.7s
টোকেন
2,151 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

দ্রুত তুলনা

তুলনার জুটি বদলান