নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.5 Flash vs StepFun: Step 3.7 Flash

সারাংশ

Gemini 3.5 Flash vs Step 3.7 Flash benchmark তুলনা: Step 3.7 Flash average score-এ এগিয়ে: 7.1 vs 6.8. Gemini 3.5 Flash-এর benchmark খরচ কম: $0.108 vs $1.148. Gemini 3.5 Flash দ্রুত: 1.57s vs 64.46s, pass rates 68.3% vs 63.5%.

প্রস্তাবিত মডেল: Gemini 3.5 Flash - Its score stays close to the best score here (6.8 vs 7.1), while costing about 10.7x less than Step 3.7 Flash.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Gemini 3.5 Flash Gemini 3.5 Flash minimal প্রকাশ: 2026-05-19 Step 3.7 Flash Step 3.7 Flash high প্রকাশ: 2026-05-29
স্কোর 6.8 7.1
র‍্যাঙ্ক #71 #63
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.3% 63.5%
অস্থির টেস্ট 1 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.767 10.434
মোট খরচ $0.108 $1.148
ইনপুট মূল্য $1.500 / 1M $0.200 / 1M
আউটপুট মূল্য $9.000 / 1M $1.150 / 1M
মোট ইনপুট টোকেন 39,847 38,391
আউটপুট টোকেন 5,277 991,355
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 1.57s 64.46s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 5.51s 364.99s
প্রতিক্রিয়া সময় (মোট) 33.02s 1353.57s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Gemini 3.5 Flash

minimal
খরচ
$0.041
সময়
20.4s
টোকেন
4,608 tok

#63 Step 3.7 Flash

high
খরচ
$0.007
সময়
63.6s
টোকেন
6,030 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 6.5 10.0 50.0% 0 892ms 492 405 0
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 5.6 9.9 33.3% 0 2.75s 8,122 3,456 0
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 3.0 10.0 0.0% 0 3.56s 15,780 404 0
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.66s 7,548 279 0
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 899ms 633 12 0
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 922ms 486 117 0
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 6.4 5.8 66.7% 1 893ms 615 76 0
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.45s 558 282 0
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.79s 5,457 234 0
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 3.0 10.0 0.0% 0 1.76s 156 12 0
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0

দ্রুত তুলনা

তুলনার জুটি বদলান