নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs Kimi K2.6

Trinity Large Thinking (medium) average score-এ এগিয়ে: 6.0 vs 5.8. Kimi K2.6-এর benchmark খরচ কম: $0.158 vs $0.792. Kimi K2.6 দ্রুত: 19.58s vs 84.96s, pass rates 45.5% vs 34.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#150
মোট আউটপুট টোকেন
1,002,646
প্রতিক্রিয়া সময় (গড়)
84.96s
মোট খরচ
$0.792
র‍্যাঙ্ক
#155
মোট আউটপুট টোকেন
30,253
প্রতিক্রিয়া সময় (গড়)
19.58s
মোট খরচ
$0.158
প্রস্তাবিত মডেল Kimi K2.6

Its score stays close to the best score here (5.8 vs 6.0), while costing about 5.0x less than Trinity Large Thinking (medium).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking medium প্রকাশ: 2026-07-28 Kimi K2.6 Kimi K2.6 none প্রকাশ: 2026-04-20
স্কোর 6.0 5.8
র‍্যাঙ্ক #150 #155
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.6 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 45.5% 34.9%
অস্থির টেস্ট 7 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 11.308 3.199
মোট খরচ $0.792 $0.158
ইনপুট মূল্য $0.220 / 1M $0.646 / 1M
আউটপুট মূল্য $0.850 / 1M $2.720 / 1M
মোট ইনপুট টোকেন 118,477 116,970
আউটপুট টোকেন 148,823 30,253
রিজনিং টোকেন 853,823 0
প্রতিক্রিয়া সময় (গড়) 84.96s 19.58s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 525.14s 238.89s
প্রতিক্রিয়া সময় (মোট) 1869.16s 430.85s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
খরচ
$0.016
সময়
75.9s
টোকেন
19,401 tok

#155 MoonshotAI: Kimi K2.6

none
খরচ
$0.020
সময়
127.4s
টোকেন
4,429 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0

দ্রুত তুলনা

তুলনার জুটি বদলান