নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Thinking Machines: Inkling

Laguna S 2.1 (medium) average score-এ এগিয়ে: 5.4 vs 5.2. Laguna S 2.1 (medium)-এর benchmark খরচ কম: $0.059 vs $0.147. Inkling দ্রুত: 3.50s vs 58.43s, pass rates 25.8% vs 28.8%.

প্রস্তাবিত মডেলInklingIts score stays close to the best score here (5.2 vs 5.4), while responding about 16.7x faster than Laguna S 2.1 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Laguna S 2.1 Laguna S 2.1 medium প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য Inkling Inkling none প্রকাশ: 2026-07-18
স্কোর 5.4 5.2
র‍্যাঙ্ক #164 #172
নির্ভরযোগ্যতা 9.8 9.9
ধারাবাহিকতা 8.4 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.8% 28.8%
অস্থির টেস্ট 4 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.451 2.448
মোট খরচ $0.059 $0.147
ইনপুট মূল্য $0.100 / 1M $1.000 / 1M
আউটপুট মূল্য $0.200 / 1M $4.050 / 1M
মোট ইনপুট টোকেন 86,641 104,111
আউটপুট টোকেন 97,298 10,551
রিজনিং টোকেন 242,297 0
প্রতিক্রিয়া সময় (গড়) 58.43s 3.50s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 560.31s 48.02s
প্রতিক্রিয়া সময় (মোট) 1285.48s 77.09s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
খরচ
$0.001
সময়
4.0s
টোকেন
867 tok

#172 Thinking Machines: Inkling

none
Provider returned error
খরচ
$0.000
সময়
5.3s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Inkling 4.5 10.0 0.0% 0 1.01s 7,356 436 0

দ্রুত তুলনা

তুলনার জুটি বদলান