নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs Qwen: Qwen3.6 Max Preview

সারাংশ

Seed-2.0-Mini vs Qwen3.6 Max Preview benchmark তুলনা: average score প্রায় সমান: 6.9 vs 6.9. Seed-2.0-Mini-এর benchmark খরচ কম: $0.044 vs $0.075. Qwen3.6 Max Preview দ্রুত: 3.30s vs 80.22s, pass rates 57.1% vs 58.7%.

প্রস্তাবিত মডেল: Qwen3.6 Max Preview - It has the best score here (6.9), while responding about 24.3x faster than Seed-2.0-Mini.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-10

মেট্রিক Seed-2.0-Mini Seed-2.0-Mini medium প্রকাশ: 2026-02-14 Qwen3.6 Max Preview Qwen3.6 Max Preview none প্রকাশ: 2026-04-20
স্কোর 6.9 6.9
র‍্যাঙ্ক #74 #75
নির্ভরযোগ্যতা 6.7 10.0
ধারাবাহিকতা 9.3 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.1% 58.7%
অস্থির টেস্ট 2 2
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.397 0.824
মোট খরচ $0.044 $0.075
ইনপুট মূল্য $0.100 / 1M $1.040 / 1M
আউটপুট মূল্য $0.400 / 1M $6.240 / 1M
মোট ইনপুট টোকেন 41,904 42,509
আউটপুট টোকেন 2,555 4,779
রিজনিং টোকেন 95,974 0
প্রতিক্রিয়া সময় (গড়) 80.22s 3.30s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 262.83s 20.51s
প্রতিক্রিয়া সময় (মোট) 1363.72s 69.40s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Seed-2.0-Mini

medium
Cost
$0.002
Time
161.7s
Tokens
4,379 tok

#75 Qwen3.6 Max Preview

none
Cost
$0.025
Time
83.9s
Tokens
4,066 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 6.6 10.0 50.0% 0 74.75s 791 360 9,520
Qwen3.6 Max Preview 5.2 7.9 41.7% 1 2.63s 696 513 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 10.0 10.0 100.0% 0 262.83s 16,533 404 29,806
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 20.51s 14,949 2,842 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 10.0 10.0 100.0% 0 24.27s 8,568 246 2,743
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.87s 7,794 243 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 3.0 10.0 0.0% 0 0ms 0 0 0
Qwen3.6 Max Preview 7.7 10.0 66.7% 0 1.22s 789 18 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 5.1 3.4 33.3% 1 36.65s 585 213 4,210
Qwen3.6 Max Preview 4.3 10.0 0.0% 0 1.62s 522 76 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 10.0 10.0 100.0% 0 17.47s 840 69 2,050
Qwen3.6 Max Preview 9.8 10.0 100.0% 0 1.40s 711 69 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 8.2 7.2 88.9% 1 31.79s 903 527 5,667
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 2.65s 714 321 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 10.0 10.0 100.0% 0 88.68s 9,585 222 5,235
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 5.27s 8,211 222 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Mini 3.0 10.0 0.0% 0 56.76s 276 50 1,779
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 1.97s 210 19 0

দ্রুত তুলনা

তুলনার জুটি বদলান