নেভিগেশন
Advertise here

Ling 3.0 Tiny (high) vs Decider V1.1 27B (default)

Ling 3.0 Tiny (high) average score-এ এগিয়ে: 3.7 vs 2.6. Ling 3.0 Tiny (high)-এর benchmark খরচ কম: $0.000 vs $0.002. Decider V1.1 27B (default) দ্রুত: 320ms vs 72.24s, pass rates 23.2% vs 17.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-07

তুলনা করা মডেল

র‍্যাঙ্ক
#373
মোট আউটপুট টোকেন
939,018
প্রতিক্রিয়া সময় (গড়)
72.24s
মোট খরচ
$0.000
র‍্যাঙ্ক
#395
মোট আউটপুট টোকেন
69
প্রতিক্রিয়া সময় (গড়)
320ms
মোট খরচ
$0.002
প্রস্তাবিত মডেল Ling 3.0 Tiny (high)

এই তুলনায় এটির স্কোর সর্বোচ্চ (3.7) এবং 2টি মডেলের মধ্যে খরচ ও সাড়া দেওয়ার সময়ের সামগ্রিক ভারসাম্য সবচেয়ে ভালো।

বিস্তারিত তুলনা

মেট্রিক Ling 3.0 Tiny Ling 3.0 Tiny high প্রকাশ: 2026-08-07 Decider V1.1 27B Decider V1.1 27B default প্রকাশ: 2026-10-07
স্কোর 3.7 2.6
র‍্যাঙ্ক #373 #395
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 5.2
প্রচেষ্টা 69/69 36/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 23.2% 17.4%
অস্থির টেস্ট 3 0
মোট রান 69 36
প্রতি ফলাফলে খরচ 0.000 0.037
মোট খরচ $0.000 $0.002
ইনপুট মূল্য $0.000 / 1M $0.020 / 1M
আউটপুট মূল্য $0.000 / 1M $0.000 / 1M
ক্যাশ পড়ার মূল্য প্রযোজ্য নয় প্রযোজ্য নয়
ক্যাশ লেখার মূল্য প্রযোজ্য নয় প্রযোজ্য নয়
মোট ইনপুট টোকেন 115,314 73,557
আউটপুট টোকেন 133,965 69
রিজনিং টোকেন 816,718 0
প্রতিক্রিয়া সময় (গড়) 72.24s 320ms
প্রতিক্রিয়া সময় (সর্বোচ্চ) 345.15s 491ms
প্রতিক্রিয়া সময় (মোট) 1589.23s 3.84s
প্যারামিটার 7.9B মোট (1.3B সক্রিয়) 27B
উপলভ্যতা উন্মুক্ত উৎস উন্মুক্ত উৎস

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#373 Ling 3.0 Tiny

high
No output was saved. The original provider response or failure reason is unavailable.
খরচ
$0.000
সময়
169.5s
টোকেন
5,252 tok

#395 Decider V1.1 27B

default
এই মডেলের জন্য এখনও কোনো শোকেস ফলাফল তৈরি হয়নি।
খরচ
প্রযোজ্য নয়
সময়
-
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Ling 3.0 Tiny 2.9 10.0 0.0% 0 177.65s 7,767 59,320 177,922
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

তুলনার জুটি বদলান

Ling 3.0 TinyhighvsNemotron 3.5 Lightningnoneবিনামূল্যে উপলভ্যGranite 4.1 8bdefaultvsLing 3.0 TinyhighLing 3.0 TinyhighvsGrok 4.20noneCommand A+mediumvsLing 3.0 TinyhighLing 3.0 TinyhighvsQwen3.5-9BmediumCommand A+lowvsDecider V1.1 27BdefaultMercury 2.5nonevsLing 3.0 TinyhighCommand A+nonevsDecider V1.1 27BdefaultLing 3.0 Tinyhighvsgpt-oss-120bnoneLing 3.0 TinyhighvsGLM 4.7 FlashmediumLing 3.0 TinyhighvsMiniMax M2.5mediumCommand A+highvsDecider V1.1 27Bdefault