নেভিগেশন
AI BENCHY
Advertise here

Seed-2.0-Lite (medium) vs Qwen3.8 27B (medium)

average score প্রায় সমান: 7.8 vs 7.8. স্থানীয় হার্ডওয়্যারের খরচ মাপা হয়নি, তাই খরচের তুলনা পাওয়া যায় না। Qwen3.8 27B (medium) দ্রুত: 33.05s vs 47.94s, pass rates 69.7% vs 66.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#69
মোট আউটপুট টোকেন
101,296
প্রতিক্রিয়া সময় (গড়)
47.94s
মোট খরচ
$0.236
র‍্যাঙ্ক
#68
মোট আউটপুট টোকেন
136,162
প্রতিক্রিয়া সময় (গড়)
33.05s
মোট খরচ
প্রযোজ্য নয়
প্রস্তাবিত মডেল Seed-2.0-Lite (medium)

It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক Seed-2.0-Lite Seed-2.0-Lite medium প্রকাশ: 2026-02-14 Qwen3.8 27B Qwen3.8 27B medium প্রকাশ: 2026-08-14
স্কোর 7.8 7.8
র‍্যাঙ্ক #69 #68
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 8.6 9.7
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.7% 66.7%
অস্থির টেস্ট 4 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.809 প্রযোজ্য নয়
মোট খরচ $0.236 প্রযোজ্য নয়
ইনপুট মূল্য $0.250 / 1M প্রযোজ্য নয়
আউটপুট মূল্য $2.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 129,906 98,266
আউটপুট টোকেন 12,530 1,861
রিজনিং টোকেন 88,766 134,301
প্রতিক্রিয়া সময় (গড়) 47.94s 33.05s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 254.92s 214.63s
প্রতিক্রিয়া সময় (মোট) 1054.57s 694.04s
প্যারামিটার ~200B মোট (~20B সক্রিয়) 27.3B
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Seed-2.0-Lite

medium
খরচ
$0.005
সময়
86.7s
টোকেন
2,354 tok

#68 Qwen3.8 27B

medium
খরচ
প্রযোজ্য নয়
সময়
43.4s
টোকেন
2,956 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

দ্রুত তুলনা

তুলনার জুটি বদলান

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 ProhighDeepSeek V4 ProhighvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 Flash 0423highGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumSeed-2.0-LitemediumvsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BmediumSeed-2.0-LitemediumvsGPT-5.2 Chatnone