নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Thinking (low) vs Qwen3.5-35B-A3B

average score প্রায় সমান: 6.0 vs 6.1. Qwen3.5-35B-A3B-এর benchmark খরচ কম: $0.106 vs $0.656. Qwen3.5-35B-A3B দ্রুত: 12.72s vs 96.78s, pass rates 48.5% vs 43.9%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#145
মোট আউটপুট টোকেন
815,220
প্রতিক্রিয়া সময় (গড়)
96.78s
মোট খরচ
$0.656
র‍্যাঙ্ক
#142
মোট আউটপুট টোকেন
86,614
প্রতিক্রিয়া সময় (গড়)
12.72s
মোট খরচ
$0.106
প্রস্তাবিত মডেল Qwen3.5-35B-A3B

It has the best score here (6.1), while costing about 6.2x less than Trinity Large Thinking (low).

বিস্তারিত তুলনা

মেট্রিক Trinity Large Thinking Trinity Large Thinking low প্রকাশ: 2026-07-28 Qwen3.5-35B-A3B Qwen3.5-35B-A3B none প্রকাশ: 2026-02-24
স্কোর 6.0 6.1
র‍্যাঙ্ক #145 #142
নির্ভরযোগ্যতা 9.7 10.0
ধারাবাহিকতা 7.9 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 48.5% 43.9%
অস্থির টেস্ট 6 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.199 1.578
মোট খরচ $0.656 $0.106
ইনপুট মূল্য $0.220 / 1M $0.140 / 1M
আউটপুট মূল্য $0.850 / 1M $1.000 / 1M
মোট ইনপুট টোকেন 122,845 134,521
আউটপুট টোকেন 117,704 86,614
রিজনিং টোকেন 697,516 0
প্রতিক্রিয়া সময় (গড়) 96.78s 12.72s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 540.96s 209.15s
প্রতিক্রিয়া সময় (মোট) 2129.13s 279.90s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
খরচ
$0.021
সময়
173.2s
টোকেন
24,586 tok

#142 Qwen3.5-35B-A3B

none
খরচ
$0.005
সময়
28.4s
টোকেন
4,518 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
Qwen3.5-35B-A3B 5.5 10.0 33.3% 0 1.39s 7,808 571 0

দ্রুত তুলনা

তুলনার জুটি বদলান