নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs Qwen3.5-Flash

Qwen3.5-Flash average score-এ এগিয়ে: 6.1 vs 6.0. Qwen3.5-Flash-এর benchmark খরচ কম: $0.073 vs $0.792. Qwen3.5-Flash দ্রুত: 25.28s vs 84.96s, pass rates 45.5% vs 39.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#150
মোট আউটপুট টোকেন
1,002,646
প্রতিক্রিয়া সময় (গড়)
84.96s
মোট খরচ
$0.792
র‍্যাঙ্ক
#140
মোট আউটপুট টোকেন
209,201
প্রতিক্রিয়া সময় (গড়)
25.28s
মোট খরচ
$0.073
প্রস্তাবিত মডেল Qwen3.5-Flash

It has the best score here (6.1), while costing about 10.9x less than Trinity Large Thinking (medium).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking medium প্রকাশ: 2026-07-28 Qwen3.5-Flash Qwen3.5-Flash none প্রকাশ: 2026-02-24
স্কোর 6.0 6.1
র‍্যাঙ্ক #150 #140
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.6 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 45.5% 39.4%
অস্থির টেস্ট 7 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 11.308 0.933
মোট খরচ $0.792 $0.073
ইনপুট মূল্য $0.220 / 1M $0.065 / 1M
আউটপুট মূল্য $0.850 / 1M $0.260 / 1M
মোট ইনপুট টোকেন 118,477 282,347
আউটপুট টোকেন 148,823 209,201
রিজনিং টোকেন 853,823 0
প্রতিক্রিয়া সময় (গড়) 84.96s 25.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 525.14s 480.96s
প্রতিক্রিয়া সময় (মোট) 1869.16s 556.24s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#150 Trinity Large Thinking

medium
খরচ
$0.016
সময়
75.9s
টোকেন
19,401 tok

#140 Qwen3.5-Flash

none
খরচ
$0.003
সময়
47.4s
টোকেন
7,799 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Qwen3.5-Flash 5.5 10.0 33.3% 0 850ms 7,913 519 0

দ্রুত তুলনা

তুলনার জুটি বদলান