নেভিগেশন
Advertise here

Seed-2.0-Lite (medium) vs Qwen3.8 27B (medium)

average score প্রায় সমান: 7.8 vs 7.8. Qwen3.8 27B (medium)-এর benchmark খরচ কম: ~$0.058 vs $0.236. Qwen3.8 27B (medium) দ্রুত: 33.05s vs 47.94s, pass rates 69.7% vs 66.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-28

তুলনা করা মডেল

র‍্যাঙ্ক
#102
মোট আউটপুট টোকেন
101,296
প্রতিক্রিয়া সময় (গড়)
47.94s
মোট খরচ
$0.236
র‍্যাঙ্ক
#101
মোট আউটপুট টোকেন
136,162
প্রতিক্রিয়া সময় (গড়)
33.05s
মোট খরচ
~$0.058
প্রস্তাবিত মডেল Qwen3.8 27B (medium)

It has the best score here (7.8), while costing about 4.1x less than Seed-2.0-Lite (medium).

বিস্তারিত তুলনা

মেট্রিক Seed-2.0-Lite Seed-2.0-Lite medium প্রকাশ: 2026-02-14 Qwen3.8 27B Qwen3.8 27B medium প্রকাশ: 2026-08-14
স্কোর 7.8 7.8
র‍্যাঙ্ক #102 #101
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 8.6 9.7
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.7% 66.7%
অস্থির টেস্ট 4 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.809 ~0.409
মোট খরচ $0.236 ~$0.058
ইনপুট মূল্য $0.250 / 1M প্রযোজ্য নয়
আউটপুট মূল্য $2.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 129,906 98,266
আউটপুট টোকেন 12,530 1,861
রিজনিং টোকেন 88,766 134,301
প্রতিক্রিয়া সময় (গড়) 47.94s 33.05s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 254.92s 214.63s
প্রতিক্রিয়া সময় (মোট) 1054.57s 694.04s
প্যারামিটার ~200B মোট (~20B সক্রিয়) 27.3B
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 Seed-2.0-Lite

medium
খরচ
$0.005
সময়
86.7s
টোকেন
2,354 tok

#101 Qwen3.8 27B

medium
খরচ
~$0.002
সময়
43.4s
টোকেন
2,956 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

দ্রুত তুলনা

তুলনার জুটি বদলান

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 ProhighDeepSeek V4 ProhighvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 Flash 0423highGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumSeed-2.0-LitemediumvsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BmediumSeed-2.0-LitemediumvsGPT-5.2 Chatnone