নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Google: Gemini 3.1 Flash Lite

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-05-08

মেট্রিক Claude Sonnet 4.6 Claude Sonnet 4.6 none প্রকাশ: 2026-02-17 Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite none প্রকাশ: 2026-05-08
স্কোর 7.2 6.7
র‍্যাঙ্ক #61 #73
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 61.4% 57.9%
অস্থির টেস্ট 1 4
মোট রান 57 57
প্রতি ফলাফলে খরচ 2.441 0.123
মোট খরচ $0.269 $0.012
???? ??? $3.000 / 1M $0.250 / 1M
????? ??? $15.000 / 1M $1.500 / 1M
আউটপুট টোকেন 7,864 2,454
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 4.96s 1.11s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 23.84s 2.97s
প্রতিক্রিয়া সময় (মোট) 59.50s 21.13s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 1,214 0
Gemini 3.1 Flash Lite 7.5 8.4 66.7% 1 1.07s 639 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.67s 523 0
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.59s 636 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 3,766 0
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 2.73s 357 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 252 0
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 843ms 279 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 413 0
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 762ms 15 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 192 0
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 992ms 63 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 90 0
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 859ms 72 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.92s 536 0
Gemini 3.1 Flash Lite 6.3 4.8 66.7% 2 720ms 150 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 447 0
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.97s 234 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 431 0
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 733ms 9 0

দ্রুত তুলনা

তুলনার জুটি বদলান