AI BENCHY
Advertise here
#202

Trinity Large Thinking

Arcee AI প্রকাশ: 2026-07-28 পরীক্ষিত হয়েছে: 2026-07-28 10:47 arcee-ai/trinity-large-thinking::high
(high) (medium) (low)

সারাংশ

Trinity Large Thinking AI BENCHY-তে 4.8 স্কোর করে এবং #202 স্থানে আছে। এর reliability 9.9, pass rate 39.4%, মোট খরচ $0.632, এবং গড় response time 77.22s.

Trinity Large Thinking কে আলাদা করে যা: এটি অস্বাভাবিকভাবে বেশি reasoning tokens ব্যবহার করে, যা ধীর বা বেশি খরচের runs ব্যাখ্যা করতে পারে।

ধারাবাহিকতা

7.2

মোট আউটপুট টোকেন

953,758

মোট ইনপুট টোকেন

101,767

ইনপুট মূল্য

$0.220 / 1M

আউটপুট মূল্য

$0.850 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 17

প্রতি চেষ্টায় পাস রেট: 39.4%

অস্থির টেস্ট

8

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

77.22s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 510.21s

প্রতিক্রিয়া সময় (মোট): 1698.89s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
খরচ
$0.028
সময়
130.1s
টোকেন
34,387 tok

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য
2026-07-28 10:55 $0.220 / 1M $0.850 / 1M

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 6.7 8.1
কোডিং 3.7 4.7
সমন্বিত 3.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 6.3 5.8
ডোমেইন-নির্দিষ্ট 2.9 7.2
Sadharon Buddhimotta 6.5 3.4
নির্দেশনা অনুসরণ 6.3 10.0
ধাঁধা সমাধান 4.7 5.2
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল