নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs Qwen3.6 Flash

Qwen3.6 Flash average score-এ এগিয়ে: 6.1 vs 6.0. Qwen3.6 Flash-এর benchmark খরচ কম: $0.062 vs $0.656. Qwen3.6 Flash দ্রুত: 3.74s vs 96.78s, pass rates 48.5% vs 34.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#145
মোট আউটপুট টোকেন
815,220
প্রতিক্রিয়া সময় (গড়)
96.78s
মোট খরচ
$0.656
র‍্যাঙ্ক
#139
মোট আউটপুট টোকেন
30,947
প্রতিক্রিয়া সময় (গড়)
3.74s
মোট খরচ
$0.062
প্রস্তাবিত মডেল Qwen3.6 Flash

It has the best score here (6.1), while costing about 10.7x less than Trinity Large Thinking (low).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking low প্রকাশ: 2026-07-28 Qwen3.6 Flash Qwen3.6 Flash none প্রকাশ: 2026-04-20
স্কোর 6.0 6.1
র‍্যাঙ্ক #145 #139
নির্ভরযোগ্যতা 9.7 10.0
ধারাবাহিকতা 7.9 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 48.5% 34.9%
অস্থির টেস্ট 6 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.199 0.935
মোট খরচ $0.656 $0.062
ইনপুট মূল্য $0.220 / 1M $0.188 / 1M
আউটপুট মূল্য $0.850 / 1M $1.125 / 1M
মোট ইনপুট টোকেন 122,845 139,788
আউটপুট টোকেন 117,704 30,947
রিজনিং টোকেন 697,516 0
প্রতিক্রিয়া সময় (গড়) 96.78s 3.74s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 540.96s 48.79s
প্রতিক্রিয়া সময় (মোট) 2129.13s 82.38s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
খরচ
$0.021
সময়
173.2s
টোকেন
24,586 tok

#139 Qwen3.6 Flash

none
খরচ
$0.005
সময়
20.1s
টোকেন
4,211 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Qwen3.6 Flash 5.4 10.0 33.3% 0 1.79s 6,488 889 0

দ্রুত তুলনা

তুলনার জুটি বদলান