নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs Qwen3.5-Flash

average score প্রায় সমান: 6.0 vs 6.1. Qwen3.5-Flash-এর benchmark খরচ কম: $0.073 vs $0.656. Qwen3.5-Flash দ্রুত: 25.28s vs 96.78s, pass rates 48.5% vs 39.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#145
মোট আউটপুট টোকেন
815,220
প্রতিক্রিয়া সময় (গড়)
96.78s
মোট খরচ
$0.656
র‍্যাঙ্ক
#140
মোট আউটপুট টোকেন
209,201
প্রতিক্রিয়া সময় (গড়)
25.28s
মোট খরচ
$0.073
প্রস্তাবিত মডেল Qwen3.5-Flash

It has the best score here (6.1), while costing about 9.0x less than Trinity Large Thinking (low).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking low প্রকাশ: 2026-07-28 Qwen3.5-Flash Qwen3.5-Flash none প্রকাশ: 2026-02-24
স্কোর 6.0 6.1
র‍্যাঙ্ক #145 #140
নির্ভরযোগ্যতা 9.7 10.0
ধারাবাহিকতা 7.9 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 48.5% 39.4%
অস্থির টেস্ট 6 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.199 0.933
মোট খরচ $0.656 $0.073
ইনপুট মূল্য $0.220 / 1M $0.065 / 1M
আউটপুট মূল্য $0.850 / 1M $0.260 / 1M
মোট ইনপুট টোকেন 122,845 282,347
আউটপুট টোকেন 117,704 209,201
রিজনিং টোকেন 697,516 0
প্রতিক্রিয়া সময় (গড়) 96.78s 25.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 540.96s 480.96s
প্রতিক্রিয়া সময় (মোট) 2129.13s 556.24s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
খরচ
$0.021
সময়
173.2s
টোকেন
24,586 tok

#140 Qwen3.5-Flash

none
খরচ
$0.003
সময়
47.4s
টোকেন
7,799 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Qwen3.5-Flash 5.5 10.0 33.3% 0 850ms 7,913 519 0

দ্রুত তুলনা

তুলনার জুটি বদলান