নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.7 Code vs StepFun: Step 3.7 Flash

সারাংশ

Kimi K2.7 Code vs Step 3.7 Flash benchmark তুলনা: Step 3.7 Flash average score-এ এগিয়ে: 7.1 vs 7.0. Kimi K2.7 Code-এর benchmark খরচ কম: $0.669 vs $1.148. Step 3.7 Flash দ্রুত: 64.46s vs 83.60s, pass rates 66.7% vs 63.5%.

প্রস্তাবিত মডেল: Kimi K2.7 Code - Its score stays close to the best score here (7.0 vs 7.1), while costing about 1.7x less than Step 3.7 Flash.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-12

মেট্রিক Kimi K2.7 Code Kimi K2.7 Code medium প্রকাশ: 2026-06-12 Step 3.7 Flash Step 3.7 Flash high প্রকাশ: 2026-05-29
স্কোর 7.0 7.1
র‍্যাঙ্ক #65 #63
নির্ভরযোগ্যতা 9.2 10.0
ধারাবাহিকতা 7.7 8.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 63.5%
অস্থির টেস্ট 6 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 6.074 10.434
মোট খরচ $0.669 $1.148
ইনপুট মূল্য $0.950 / 1M $0.200 / 1M
আউটপুট মূল্য $4.000 / 1M $1.150 / 1M
মোট ইনপুট টোকেন 25,991 38,391
আউটপুট টোকেন 80,516 991,355
রিজনিং টোকেন 161,391 0
প্রতিক্রিয়া সময় (গড়) 83.60s 64.46s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 365.80s 364.99s
প্রতিক্রিয়া সময় (মোট) 1671.99s 1353.57s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#65 MoonshotAI: Kimi K2.7 Code

medium
Cost
$0.025
Time
138.0s
Tokens
6,093 tok

#63 Step 3.7 Flash

high
Cost
$0.007
Time
63.6s
Tokens
6,030 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 7.3 5.8 83.3% 2 11.56s 618 3,048 5,041
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 7.6 7.2 77.8% 1 146.73s 4,650 1,864 25,635
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 4.7 1.6 66.7% 1 34.83s 11,271 444 3,906
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 10.0 10.0 100.0% 0 12.27s 7,014 248 2,569
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 5.3 7.2 44.4% 1 213.29s 431 55,572 63,639
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 10.0 10.0 100.0% 0 10.78s 477 1,024 1,071
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 9.9 10.0 100.0% 0 5.39s 669 725 1,232
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 5.9 7.7 44.4% 1 41.00s 651 15,438 17,368
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 3.0 10.0 0.0% 0 0ms 0 0 0
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 3.0 10.0 0.0% 0 341.76s 210 2,153 40,930
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0

দ্রুত তুলনা

তুলনার জুটি বদলান