নেভিগেশন
AI BENCHY
Advertise here

Kimi K2.7 Code (medium) vs Qwen3.7 Max

Kimi K2.7 Code (medium) average score-এ এগিয়ে: 7.5 vs 7.4. Qwen3.7 Max-এর benchmark খরচ কম: $0.197 vs $0.692. Qwen3.7 Max দ্রুত: 4.52s vs 84.25s, pass rates 65.2% vs 68.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#60
মোট আউটপুট টোকেন
262,507
প্রতিক্রিয়া সময় (গড়)
84.25s
মোট খরচ
$0.692
র‍্যাঙ্ক
#67
মোট আউটপুট টোকেন
12,446
প্রতিক্রিয়া সময় (গড়)
4.52s
মোট খরচ
$0.197
প্রস্তাবিত মডেল Qwen3.7 Max

Its score stays close to the best score here (7.4 vs 7.5), while costing about 3.5x less than Kimi K2.7 Code (medium).

বিস্তারিত তুলনা

মেট্রিক Kimi K2.7 Code Kimi K2.7 Code medium প্রকাশ: 2026-06-12 Qwen3.7 Max Qwen3.7 Max none প্রকাশ: 2026-05-22
স্কোর 7.5 7.4
র‍্যাঙ্ক #60 #67
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.3 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 68.2%
অস্থির টেস্ট 4 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.457 1.582
মোট খরচ $0.692 $0.197
ইনপুট মূল্য $0.780 / 1M $1.475 / 1M
আউটপুট মূল্য $3.500 / 1M $4.425 / 1M
মোট ইনপুট টোকেন 72,073 95,983
আউটপুট টোকেন 83,714 12,446
রিজনিং টোকেন 178,793 0
প্রতিক্রিয়া সময় (গড়) 84.25s 4.52s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 365.80s 72.30s
প্রতিক্রিয়া সময় (মোট) 1769.22s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
খরচ
$0.025
সময়
138.0s
টোকেন
6,093 tok

#67 Qwen3.7 Max

none
খরচ
$0.046
সময়
195.0s
টোকেন
12,171 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

দ্রুত তুলনা

তুলনার জুটি বদলান