নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Preview vs Kwaipilot: KAT-Coder-Air V2.5

KAT-Coder-Air V2.5 (medium) average score-এ এগিয়ে: 5.6 vs 4.8. Trinity Large Preview-এর benchmark খরচ কম: $0.008 vs $0.048. Trinity Large Preview দ্রুত: 2.98s vs 8.42s, pass rates 21.2% vs 45.5%.

প্রস্তাবিত মডেলKAT-Coder-Air V2.5 (medium)It has the strongest score in this comparison (5.6) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক Trinity Large Preview Trinity Large Preview none প্রকাশ: 2026-01-27 KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 medium প্রকাশ: 2026-07-14
স্কোর 4.8 5.6
র‍্যাঙ্ক #183 #149
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.9 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 21.2% 45.5%
অস্থির টেস্ট 2 3
মোট রান 63 66
প্রতি ফলাফলে খরচ 0.017 0.593
মোট খরচ $0.008 $0.048
ইনপুট মূল্য $0.243 / 1M $0.150 / 1M
আউটপুট মূল্য $0.243 / 1M $0.600 / 1M
মোট ইনপুট টোকেন 29,828 51,472
আউটপুট টোকেন 2,169 7,822
রিজনিং টোকেন 0 58,352
প্রতিক্রিয়া সময় (গড়) 2.98s 8.42s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 14.34s 48.19s
প্রতিক্রিয়া সময় (মোট) 56.57s 185.24s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#183 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
খরচ
$0.000
সময়
0.0s
টোকেন
0 tok

#149 KAT-Coder-Air V2.5

medium
খরচ
$0.003
সময়
23.7s
টোকেন
4,924 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
KAT-Coder-Air V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973

দ্রুত তুলনা

তুলনার জুটি বদলান