নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (high) vs GPT-5.4 Nano

average score প্রায় সমান: 4.8 vs 4.8. GPT-5.4 Nano-এর benchmark খরচ কম: $0.041 vs $0.632. GPT-5.4 Nano দ্রুত: 2.57s vs 77.22s, pass rates 39.4% vs 28.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#202
মোট আউটপুট টোকেন
953,758
প্রতিক্রিয়া সময় (গড়)
77.22s
মোট খরচ
$0.632
র‍্যাঙ্ক
#201
মোট আউটপুট টোকেন
13,794
প্রতিক্রিয়া সময় (গড়)
2.57s
মোট খরচ
$0.041
প্রস্তাবিত মডেল GPT-5.4 Nano

It has the best score here (4.8), while costing about 15.6x less than Trinity Large Thinking (high).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking high প্রকাশ: 2026-07-28 GPT-5.4 Nano GPT-5.4 Nano none প্রকাশ: 2026-03-17
স্কোর 4.8 4.8
র‍্যাঙ্ক #202 #201
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 7.2 8.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 39.4% 28.8%
অস্থির টেস্ট 8 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 12.640 1.011
মোট খরচ $0.632 $0.041
ইনপুট মূল্য $0.220 / 1M $0.200 / 1M
আউটপুট মূল্য $0.850 / 1M $1.250 / 1M
মোট ইনপুট টোকেন 101,767 115,924
আউটপুট টোকেন 286,218 13,794
রিজনিং টোকেন 667,540 0
প্রতিক্রিয়া সময় (গড়) 77.22s 2.57s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 510.21s 25.50s
প্রতিক্রিয়া সময় (মোট) 1698.89s 56.51s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
খরচ
$0.028
সময়
130.1s
টোকেন
34,387 tok

#201 GPT-5.4 Nano

none
খরচ
$0.008
সময়
46.1s
টোকেন
5,735 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0

দ্রুত তুলনা

তুলনার জুটি বদলান