নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs StepFun: Step 3.5 Flash

সারাংশ

Seed-2.0-Lite vs Step 3.5 Flash benchmark তুলনা: Step 3.5 Flash average score-এ এগিয়ে: 6.6 vs 6.2. Seed-2.0-Lite-এর benchmark খরচ কম: $0.019 vs $0.070. Seed-2.0-Lite দ্রুত: 2.49s vs 72.53s, pass rates 46.0% vs 54.0%.

প্রস্তাবিত মডেল: Seed-2.0-Lite - Its score stays close to the best score here (6.2 vs 6.6), while costing about 3.8x less than Step 3.5 Flash.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Seed-2.0-Lite Seed-2.0-Lite none প্রকাশ: 2026-02-14 Step 3.5 Flash Step 3.5 Flash medium প্রকাশ: 2026-02-01
স্কোর 6.2 6.6
র‍্যাঙ্ক #92 #80
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.4 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 46.0% 54.0%
অস্থির টেস্ট 4 1
মোট রান 63 60
প্রতি ফলাফলে খরচ 0.228 0.198
মোট খরচ $0.019 $0.070
ইনপুট মূল্য $0.250 / 1M $0.090 / 1M
আউটপুট মূল্য $2.000 / 1M $0.300 / 1M
মোট ইনপুট টোকেন 46,573 34,431
আউটপুট টোকেন 3,259 91,587
রিজনিং টোকেন 0 195,973
প্রতিক্রিয়া সময় (গড়) 2.49s 72.53s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 6.70s 453.94s
প্রতিক্রিয়া সময় (মোট) 52.26s 1015.47s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 Seed-2.0-Lite

none
খরচ
$0.005
সময়
83.8s
টোকেন
2,311 tok

#80 Step 3.5 Flash

medium
খরচ
$0.008
সময়
277.1s
টোকেন
23,695 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 3.0 5.9 16.7% 2 2.43s 894 709 0
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 694 20,391 24,176
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 5.6 10.0 33.3% 0 2.83s 8,215 410 0
Step 3.5 Flash 2.4 5.2 0.0% 0 258.38s 2,211 13,207 22,429
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 3.0 10.0 0.0% 0 6.59s 16,215 498 0
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 13,638 1,176 12,984
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.82s 8,538 246 0
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 7,368 600 13,886
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 3.6 7.2 22.2% 1 1.33s 939 17 0
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 673 45,350 90,436
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 570 294 0
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 509 240 3,506
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 810 73 0
Step 3.5 Flash 8.3 10.0 50.0% 0 4.78s 705 2,364 3,521
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 5.3 7.2 44.4% 1 2.78s 858 709 0
Step 3.5 Flash 5.3 10.0 33.3% 0 7.22s 711 5,630 10,861
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 9,270 292 0
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 7,701 275 3,802
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 3.0 10.0 0.0% 0 1.96s 264 11 0
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 221 2,354 10,372

দ্রুত তুলনা

তুলনার জুটি বদলান