নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs GPT-5.6 Terra

Trinity Large Thinking (low) average score-এ এগিয়ে: 6.0 vs 6.0. GPT-5.6 Terra-এর benchmark খরচ কম: $0.175 vs $0.656. GPT-5.6 Terra দ্রুত: 1.65s vs 96.78s, pass rates 48.5% vs 42.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#145
মোট আউটপুট টোকেন
815,220
প্রতিক্রিয়া সময় (গড়)
96.78s
মোট খরচ
$0.656
র‍্যাঙ্ক
#148
মোট আউটপুট টোকেন
6,203
প্রতিক্রিয়া সময় (গড়)
1.65s
মোট খরচ
$0.175
প্রস্তাবিত মডেল GPT-5.6 Terra

Its score stays close to the best score here (6.0 vs 6.0), while costing about 3.8x less than Trinity Large Thinking (low).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking low প্রকাশ: 2026-07-28 GPT-5.6 Terra GPT-5.6 Terra none প্রকাশ: 2026-07-09
স্কোর 6.0 6.0
র‍্যাঙ্ক #145 #148
নির্ভরযোগ্যতা 9.7 10.0
ধারাবাহিকতা 7.9 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 48.5% 42.4%
অস্থির টেস্ট 6 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.199 4.359
মোট খরচ $0.656 $0.175
ইনপুট মূল্য $0.220 / 1M $1.250 / 1M
আউটপুট মূল্য $0.850 / 1M $7.500 / 1M
মোট ইনপুট টোকেন 122,845 102,259
আউটপুট টোকেন 117,704 6,203
রিজনিং টোকেন 697,516 0
প্রতিক্রিয়া সময় (গড়) 96.78s 1.65s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 540.96s 10.07s
প্রতিক্রিয়া সময় (মোট) 2129.13s 36.28s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
খরচ
$0.021
সময়
173.2s
টোকেন
24,586 tok

#148 GPT-5.6 Terra

none
খরচ
$0.030
সময়
14.7s
টোকেন
2,082 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5.6 Terra 5.5 10.0 33.3% 0 1.00s 7,302 336 0

দ্রুত তুলনা

তুলনার জুটি বদলান