নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs GPT-5.4 Mini

Trinity Large Thinking (low) average score-এ এগিয়ে: 6.0 vs 5.9. GPT-5.4 Mini-এর benchmark খরচ কম: $0.095 vs $0.656. GPT-5.4 Mini দ্রুত: 1.53s vs 96.78s, pass rates 48.5% vs 33.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#145
মোট আউটপুট টোকেন
815,220
প্রতিক্রিয়া সময় (গড়)
96.78s
মোট খরচ
$0.656
র‍্যাঙ্ক
#153
মোট আউটপুট টোকেন
7,880
প্রতিক্রিয়া সময় (গড়)
1.53s
মোট খরচ
$0.095
প্রস্তাবিত মডেল GPT-5.4 Mini

Its score stays close to the best score here (5.9 vs 6.0), while costing about 6.9x less than Trinity Large Thinking (low).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking low প্রকাশ: 2026-07-28 GPT-5.4 Mini GPT-5.4 Mini none প্রকাশ: 2026-03-17
স্কোর 6.0 5.9
র‍্যাঙ্ক #145 #153
নির্ভরযোগ্যতা 9.7 10.0
ধারাবাহিকতা 7.9 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 48.5% 33.3%
অস্থির টেস্ট 6 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.199 1.580
মোট খরচ $0.656 $0.095
ইনপুট মূল্য $0.220 / 1M $0.750 / 1M
আউটপুট মূল্য $0.850 / 1M $4.500 / 1M
মোট ইনপুট টোকেন 122,845 79,067
আউটপুট টোকেন 117,704 7,880
রিজনিং টোকেন 697,516 0
প্রতিক্রিয়া সময় (গড়) 96.78s 1.53s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 540.96s 9.92s
প্রতিক্রিয়া সময় (মোট) 2129.13s 33.74s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
খরচ
$0.021
সময়
173.2s
টোকেন
24,586 tok

#153 GPT-5.4 Mini

none
খরচ
$0.010
সময়
11.7s
টোকেন
2,151 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

দ্রুত তুলনা

তুলনার জুটি বদলান