নেভিগেশন
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ling 3.0 Tiny (medium) vs Tev1 4B Experimental

Ling 3.0 Tiny (medium) average score-এ এগিয়ে: 3.6 vs 1.0. Ling 3.0 Tiny (medium)-এর benchmark খরচ কম: $0.000 vs $0.002. Tev1 4B Experimental দ্রুত: 498ms vs 64.99s, pass rates 23.2% vs 13.0%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#356
মোট আউটপুট টোকেন
923,276
প্রতিক্রিয়া সময় (গড়)
64.99s
মোট খরচ
$0.000
র‍্যাঙ্ক
#381
মোট আউটপুট টোকেন
96
প্রতিক্রিয়া সময় (গড়)
498ms
মোট খরচ
$0.002
প্রস্তাবিত মডেল Ling 3.0 Tiny (medium)

It has the strongest score in this comparison (3.6) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক Ling 3.0 Tiny Ling 3.0 Tiny medium প্রকাশ: 2026-08-07 Tev1 4B Experimental Tev1 4B Experimental none প্রকাশ: 2026-09-30
স্কোর 3.6 1.0
র‍্যাঙ্ক #356 #381
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 8.9 3.0
প্রচেষ্টা 69/69 21/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 23.2% 13.0%
অস্থির টেস্ট 3 0
মোট রান 69 21
প্রতি ফলাফলে খরচ 0.000 0.048
মোট খরচ $0.000 $0.002
ইনপুট মূল্য $0.000 / 1M $0.042 / 1M
আউটপুট মূল্য $0.000 / 1M $0.000 / 1M
ক্যাশ পড়ার মূল্য প্রযোজ্য নয় প্রযোজ্য নয়
ক্যাশ লেখার মূল্য প্রযোজ্য নয় প্রযোজ্য নয়
মোট ইনপুট টোকেন 103,898 33,864
আউটপুট টোকেন 148,304 96
রিজনিং টোকেন 774,972 0
প্রতিক্রিয়া সময় (গড়) 64.99s 498ms
প্রতিক্রিয়া সময় (সর্বোচ্চ) 262.20s 602ms
প্রতিক্রিয়া সময় (মোট) 1429.68s 3.49s
প্যারামিটার 7.9B মোট (1.3B সক্রিয়) 4B
উপলভ্যতা উন্মুক্ত উৎস ওজন উপলভ্য

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#356 Ling 3.0 Tiny

medium
No output was saved. The original provider response or failure reason is unavailable.
খরচ
$0.000
সময়
177.4s
টোকেন
6,873 tok

#381 Together: Tev1 4B Experimental

none
এই মডেলের জন্য এখনও কোনো শোকেস ফলাফল তৈরি হয়নি।
খরচ
প্রযোজ্য নয়
সময়
-
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006
Tev1 4B Experimental 0.0 0.0 0.0% 0 0ms 0 0 0

দ্রুত তুলনা

তুলনার জুটি বদলান